「后训练流程」共找到 4392 篇相关文章
大模型在具身推理上「翻车」了?4496 道题全面揭示短板
美国东北大学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态大模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。
DeepSeek最会讨好,LLM太懂人情世故了,超人类50%
研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。
揭秘OpenAI 1.5万亿美元交易内幕:奥特曼核心圈子主导,绕开银行家和律师
OpenAI CEO Sam Altman与内部核心高管圈子主导1.5万亿美元系列交易,绕开银行家和律师。交易呈技术优先、财务后置非传统模式,如与英伟达、AMD等多笔重磅交易,还介绍了绕开外部顾问原因。
LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统
加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。
机器人连续叠衣120分钟!仅用0.9B参数实现五大SOTA|清华AIR & 上海AI Lab开源
清华大学智能产业研究院与上海人工智能实验室联合发布通用跨本体具身基座模型X-VLA。它是首个实现120min无辅助自主叠衣的全开源模型,仅0.9B参数量就在五大权威仿真基准刷新纪录。
对话 OPPO AI 姜昱辰:手机才是 Memory 最好的土壤,AI 一定会彻底改变智能手机
文章是对OPPO AI姜昱辰的访谈。他认为AI会改变智能手机,OPPO将小布记忆做成跨系统收藏夹。产品迭代后记得更广、更深、更有用,团队还探索记忆分层、更新等,也重视用户隐私和主动推荐能力提升。
蚂蚁开源万亿参数思考模型 Ring-1T,综合能力逼近 GPT-5、数学能力对标 IMO 银牌
10月14日凌晨,蚂蚁集团推出万亿参数思考模型Ring-1T并全面开源。它在多任务榜单表现均衡,数学能力达IMO银牌水平,通用能力逼近GPT - 5,还采用自研算法应对行业难题,目前可下载体验。
Qoder + ADB Supabase :5分钟GET超火AI手办生图APP
本文介绍如何用Qoder、阿里云ADB Supabase和通义千问图像编辑模型,快速搭建AI手办生图Flutter移动端应用,无需自建传统后端,涵盖思路、环境准备、各环节配置及流程等内容。
更大,还能更快,更准!蚂蚁开源万亿参数语言模型Ling-1T,刷新多项SOTA
10月9日,蚂蚁开源万亿参数语言模型Ling-1T。它延续自研高效MoE架构,在编程、数学推理等多维度测试表现亮眼,还能兼顾精确与效率。此外,它在多场景实用性强,其创新设计提升了能效比与性能。
3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归
MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据集,视频存档公布助理解原理。