测试时深思」共找到 2281 篇相关文章

算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心
算法论文8

物理-数据双驱动的大迎角非定常气动力建模 | 航空学报CJA

现代飞行器大迎角机动,气动力复杂,现有建模方法面临两难。论文提出DEM - LSTM混合框架,结合专家经验与数据驱动,解决小样本、强非线性挑战,经算例验证性能优势明显。

力学与人工智能
推荐文章7

MCP 丸辣?不不不,Agent 进生产都绕不开 MCP

文章指出 Agent 连接外部系统通常有直接 API 调用、CLI 及 MCP 三种方式,构建生产级 Agent 目前 MCP 更靠谱。分析各方式优劣,还介绍了 MCP 封装方法。

MacTalk
算法论文7

外国科学家从汉字中找到了设计超强材料的灵感!“天”字形材料最坚固

4月21日爱丁堡大学研究人员在《应用物理学杂志》发文,将“人”“大”“天”“夫”字形转化为超材料结构单元,经压缩实验发现汉字字形中藏力学规律,“天”字形材料性能最优。

DeepTech深科技
算法论文8

Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果

Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。

PaperAgent
8

Claude Design暴击设计行业!Figma、Adobe市值闪崩

Anthropic Labs推出AI原生视觉设计协作平台Claude Design,由Claude Opus 4.7驱动,向Adobe等设计软件巨头发起挑战。它有三大杀手级功能,能大幅提高设计效率,引发资本市场震动。

量子位
算法论文8

让离线强化学习从「局部描摹」变「全局布局」丨ICLR'26

现有生成式离线强化学习方法在复杂连续任务长程规划中易陷入局部合理但全局偏航的窘境。厦门大学和香港科技大学提出MAGE算法,采用自顶向下策略,实验显示其多任务表现出色、推理效率高。

量子位
产品应用8

龙虾创始人深夜点赞:百度 DuMate,打工人的 AI 搭子

文章介绍百度新上线的产品 DuMate,它被定位为首个「国产企业级满血版 OpenClaw」。安装简单,能深度集成百度工具生态,部署方便且安全。通过多场景实测,其任务完成度高,是打工人实用的 AI 搭子。

特工宇宙
开源动态8

LeCun的世界模型单GPU就能跑了

LeCun世界模型有新进展,开源极简训练方案LeWorldModel,单GPU就能跑,基于JEPA架构,速度快、参数小、控制强且懂物理,完胜此前JEPA方法,训练更简单。

量子位
开源动态8

一夜之间,AI终获「永久记忆」!最难考试99%刷爆SOTA,全网直呼疯狂

新智元报道,Supermemory团队推出超级记忆系统ASMR,在AI记忆界最难考试LongMemEval中刷到99%准确率。它抛弃传统模式,采用多Agent并行推理,4月初将开源代码。此外,其背后的Supermemory引擎功能强大,能让AI真正拥有记忆。

新智元