「后训练算法」共找到 4117 篇相关文章
“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!
7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。
Manus 重新独立:这七个月一直没停下,但通用 Agent 的牌桌已经挤满了玩家
8月11日,Manus宣布将恢复独立运营,此前它被Meta收购仅七个月。过去七个月其产品更新频繁,年收入大幅增长。但通用Agent竞争激烈,OpenAI等大厂及创业公司纷纷入局,Manus需做深产品,且重新独立后面临增长考验。
北大、字节、中科院自动化研究所等提出图像并行生成新范式
北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。
AI让全人类思维越来越雷同!南加大研究实锤:认知多样性正在被抹平
南加州大学论文指出,AI正让全人类想法和表达同质化,体现在语言、视角和推理三方面。原因包括训练数据有偏差、训练目标求稳、人们过度依赖。研究人员虽在想办法,但效果有限,呼吁勿无节制依赖。
智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队
如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。
Hinton与姚期智对谈:认为人类的意识特殊,那是危险的无稽之谈
图灵奖得主Geoffery Hinton与姚期智对谈AI相关话题。Hinton认为人脑可给AI借鉴,还探讨人类未来与AI道德,强调训练善良AI重要;他觉得大模型有理解能力,将人类意识特殊化是危险无稽之谈。
清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026
在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。
一杯咖啡,3亿美金!斯坦福天才少女退学创业,Meta AI大牛排队加入
2024年,斯坦福博士生Carina Hong与前Meta AI研究员交谈后,退学创办Axiom Math,目标打造「AI数学家」。公司首轮融资6400万美元后估值3亿美元,吸引Meta等公司顶尖AI人才,虽面临竞争,但前景广泛。
Anthropic 在 Claude 内部发现"全局工作空间",可以直接读取模型没说出口的想法
Anthropic发布研究,在Claude内部发现J - space(雅可比空间),即“全局工作空间”,它在训练中自发形成。用雅可比透镜技术可读取其内容,还验证了其功能属性,可用于对齐审计等。
别高估车企“造人”
今年5月特斯拉停产后搭建Optimus量产线,虽强调FSD算法可复用,却未量产。车企造机器人,优势在供应链管理和生产制造,算法移植效果一般,且面临数据难题,竞赛中暂无通关密码。