「决策边界」共找到 606 篇相关文章
DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!
清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。
对话港理工吕佳欣:如何将一项实验室成果变成一条6500吨级的生产线?
文章是对港理工吕佳欣的访谈,围绕多筒挤压技术展开,探讨从实验室到产业化的过程、挑战及应对方法,还提及工业AI在制造领域的应用,如数据处理、经验转化等,强调科研与工程相互促进。
Thin Harness, Fat Skills:AI工程架构的本质
文章介绍了AI工程架构本质,阐述Garry Tan倡导的智能体工程三原则,分析架构分层,包括Fat Skills、Fat Code和Thin Harness层,还通过案例展示技能文件进化特性,提及社区讨论、边界迁移和工程纪律价值。
Agentic AI 时代,软件工程如何被重塑|QCon北京2026即将开幕
QCon全球软件开发大会·2026北京站4月举办,以“Agentic AI时代的软件工程重塑”为主题。大会有主题演讲探讨Agentic AI边界,设多个专题解析工程化核心,还关注AI向物理世界延伸,讲师分享一线实践经验。
「龙虾热」后,OpenClaw 会是又一个泡沫吗?
OpenClaw是受高度关注的开源项目,发布一周吸引200万访问、超10万GitHub星标。热度外溢到产品和产业,厂商推「类龙虾」产品,应用边界向AI硬件延伸,地方政府也推出支持举措,但围绕其争议也在积累。
李曼玲、李飞飞、吴佳俊等联手:评估具身大模型的新范式!
全新的具身模型空间能力评估范式Theory of Space突破传统局限,考察模型在动态环境构建、修正和利用空间信念的能力。该论文被ICLR 2026接收,研究对前沿多模态大模型评测,揭示其空间认知能力边界。
设计流程已死:Anthropic 设计负责人 Jenny Wen 谈 AI 时代的设计变革
Anthropic的Claude设计负责人Jenny Wen在Lenny's Podcast中谈AI时代设计变革。她指出传统设计流程被工程速度倒逼走向尽头,还分享在AI实验室做设计的感受、Co - work开发故事等,给出招聘设计师的标准。
AgentIF-OneDay 发布,评估全场景长时复杂任务
红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。
刚刚,智元提出SOP,让VLA模型在真实世界实现可扩展的在线进化
智元具身研究中心提出SOP框架,可让VLA模型在真实世界实现可扩展的在线进化。它是颠覆性的机器人学习新范式,整合在线、分布式和多任务机制,构建闭环打破机器人认知时间边界。实验显示其性能优越。
谷歌发布智能体Scaling Law:180组实验打破传统炼金术
谷歌新论文通过180组实验找到智能体的Scaling Law(定量扩展原则),在四个基准测试评估,推导预测模型,实验结果颠覆直觉,还量化阻碍因素,发现不同模型协作性格,为智能体部署决策提供支撑。