「球体堆积问题」共找到 3197 篇相关文章
谁说Scaling Law到头了?新研究:每一步的微小提升会带来指数级增长
很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但新研究发现,模型单步准确率的微小提升能使完成任务长度指数级增长,还探讨了长程执行能力的衡量及影响因素。
刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相
OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。
AlphaGo作者领衔,8个机械臂协同干活0碰撞,DeepMind新作登Science子刊
DeepMind等机构成果RoboBallet登Science子刊。它将图神经网络用于强化学习,可控制8个机械臂协同无碰撞工作。核心是结合图神经网络与强化学习,解决多机器人协作复杂问题,实验表现出色。
Hinton万万没想到,前女友用ChatGPT跟他闹分手
Hinton在接受采访时爆料前女友用ChatGPT和他分手。访谈中他分享AI观点,认为人类应让AI成母亲,还谈到用ChatGPT研究、问修理问题等,也纠正从谷歌离职原因。
英伟达推出通用深度研究系统,可接入任何LLM,支持个人定制
英伟达推出通用深度研究(UDR)系统,支持个人定制,可接入任何大语言模型。它能解决现有深度研究智能体的局限性,有诸多创新特性,但目前还在原型阶段,存在一定局限性。
Parlant:一个让AI Agent 真正听话的开源框架
AI Agent存在不听话的痛点,Parlant开源框架专门解决此问题。它与传统方法不同,能确保执行规则。具备行为准则、对话流程等功能模块,适用于金融、医疗等场景,已在金融场景落地。
避免Claude Code 降智的一小招
Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。
告别无效计算!新TTS框架拯救19%被埋没答案,推理准确率飙升
现有TTS方法存在路径同质化和中间结果利用不足问题。华为诺亚方舟实验室等机构提出SRCA框架,含检查点注入、答案聚类搜索和检查点候选增强组件,实验显示能提升推理准确性、效率,降低成本。
Meta提出StepWiser,让模型学会“反思”自己的推理过程
Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。
谷歌认领最强AI版Photoshop!现在人人可用,效果确实强悍
谷歌认领神秘图像编辑模型nano - banana,即Gemini 2.5 Flash Image。它可免费在Gemini和Google AI Studio使用,API收费。该模型图像编辑能力出色,能合并图片、实现2D到3D转换等,此前爆火却无官方文档。