「智能搜索」共找到 3758 篇相关文章
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。
景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态大模型在线时空理解短板
上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战大模型能力。它更贴近真实世界,揭示主流多模态大模型在线时空理解短板,为未来模型发展指明方向。
「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习
近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
稚晖君机器人炸场:全球首秀“真男人必会的韦伯斯特空翻”
智元的灵犀X2成全球首个完成韦伯斯特空翻的机器人,该动作对腿部爆发力和协调性要求高。稚晖君介绍其攻克难点的原理,完成此动作验证了硬件可靠性,也体现机器人应对复杂环境的能力。
全球图生视频榜单第一,爱诗科技PixVerse V5如何改变一亿用户的视频创作
爱诗科技PixVerse(拍我AI)功能丰富,普通用户可用热门模板整活,创作者有多样创作工具。其最新V5模型在图生视频项目全球排名第一,在多方面技术革新,推动AI视频创作发展。
专访 RockFlow Vakee:AI 如何重构投资体验,让金融“说人话”
该专访对话 RockFlow 创始人 Vakee,探讨 AI 重构投资体验。她分享创业初衷、团队理念及人才需求,还谈及 GenZ 投资特点与 RockFlow 应对策略,介绍了 Bobby 功能、规划及 RockFlow 在金融科技领域的发展方向。
特斯拉下一代金色Optimus原型现身?一双「假手」成为最大槽点
Salesforce CEO发布与金色Optimus对话视频,盛赞其开启物理智能体革命。不过,其高昂价格、“假手”设计引争议。对比Figure机器人精准装碗视频,特斯拉Optimus表现不尽如人意,是否遇麻烦引人猜测。
对话逐际动力张巍:造机器人很容易,关键是用起来
量子位对话逐际动力创始人张巍,他表示人形机器人本体硬件制造容易,难点在大脑和小脑AI化能力。逐际动力要做技术平台,降低开发门槛,目标是让天下没有难落地的机器人。
OpenAI女CEO太狠了!智商148,GPT-5才是真印钞机
GPT-5智商高达148,在多基准测试表现亮眼获英伟达认可。OpenAI借“路由器”为ChatGPT商业化铺路,它能分流降成本、让免费用户接触深度思考模型,还可变身广告分配器,实现AI广告变现。