「通用多模态推理」共找到 3315 篇相关文章
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。
开源“裸考”真实世界,国产具身智能基座模型拿下全球第二!
国产具身智能基座模型WALL - OSS在RoboChallenge真机评测榜单获全球第二,多个单任务排第一。它是开源模型,开源程度彻底。还介绍其技术突破及团队情况,强调开源对具身智能发展意义重大。
AAAI 2026 Oral|InfiGUI-G1模型来了,刷新GUI Grounding SOTA
多模态大语言模型发展下,GUI Grounding任务是难题,现有RLVR方法有瓶颈。浙江大学等团队提出AEPO框架,推出InfiGUI - G1系列模型,小参数量刷新GUI基准测试SOTA,代码已开源。
不装了!LeCun哈萨比斯神仙吵架,马斯克也站队了
图灵奖得主Yann LeCun与诺贝尔奖得主、谷歌DeepMind CEO哈萨比斯就“智能的本质”展开激辩,马斯克站队哈萨比斯。二人观点分歧大,后LeCun称主要是用词分歧,双方都关注世界模型,但理解和实践有别。
RL是「点金石」还是「挖掘机」?CMU 用可控实验给出答案
卡耐基梅隆大学研究者构建基于GSM - Infinite的可控合成数据框架,分析预训练、中期训练和RL对模型推理泛化能力的影响,调和了RL有效性的不同观点,为改进训练策略提供基础。
医疗AI智能体全面综述:行业爆发,年增长130%!
研究人员发布医疗健康AI智能体全面综述,梳理其全生命周期。数据显示截至2025年相关论文较2024年增超130%。研究前沿在数据、技术、应用上扩展,同时指出面临的挑战与未来方向。
马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1
谷歌Gemini 3将上线消息正热时,马斯克旗下xAI的Grok 4.1凌晨上线。它有两个“形态”,免费开放且有APP版。在LMArena测试中表现优异,事实稳定性、情商、创意写作等能力提升,实测也有不错表现。
强化学习 AI 系统的设计实现及未来发展
本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。
Meta这两篇最新Agent Learning论文,有些意思!
分享Meta SuperLabs两篇Agent Learning论文,从‘如何低成本获得高质量经验’出发,形成技术链,为语言智能体进入‘规模化RL时代’提供路线图,还分析了Agent RL问题及两论文成果、对比。
小鹏IRON“脱皮证非人”、字节豪掷800多亿,人形机器人竞争太激烈啦!
国内人形机器人赛道白热化,小鹏 IRON 步态逼真引争议,字节跳动高薪招聘并拟投巨资开发 AI 芯片。多家企业推出新机器人,大厂纷纷入局。未来,行业发展看法不一。