「设计效率」共找到 2394 篇相关文章
分享2篇最新Harness论文,一篇谷歌,一篇微软
在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。
让离线强化学习从「局部描摹」变「全局布局」丨ICLR'26
现有生成式离线强化学习方法在复杂连续任务长程规划中易陷入局部合理但全局偏航的窘境。厦门大学和香港科技大学提出MAGE算法,采用自顶向下策略,实验显示其多任务表现出色、推理效率高。
这个 skills 太硬核了,刚开源就斩获 1.7K Star!Agent 联网能力拉满!
AI开发者圈热议让AI助手真正“上网”,Claude Code原工具局限性大。web - access skill横空出世,从底层架构重新设计,解决其三大短板,让Claude Code可自由穿梭互联网,功能强大且安装使用方便。
让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方
上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。
离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式
杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。
马斯克要自己做「英伟达+台积电」!宇宙芯片宏图开工,算力产能扩5000%
马斯克宣布启动史上最大规模芯片计划Terafab,目标是每年生产超1太瓦算力,80%部署至太空。该计划将芯片设计到制造整合,为机器人、AI和太空数据中心造芯片,不过暂无具体时间线。
Claude Code、Cursor 可能都躲不过一次“大重写”,但 OpenCode 也许是例外
文章指出Claude Code、Cursor等AI编程工具因开发方式问题,代码库陷入难逆转状态,或迎“大规模重写潮”。而OpenCode强调代码一致性,代码库更干净。其创始人分享开发经验、工作流及对行业现象的看法。
刚刚,小云雀的短剧Agent上线了,背后是字节自己的Seedance 2.0。
字节的小云雀短剧Agent上线,以Seedance 2.0为底层模型。它能根据剧本或设定自动生成高质量短剧,提升了AI短剧创作效率,且不挑风格。文中还介绍了使用流程及剧本创作方法。
卡帕西630行代码炸出81个智能体,4天协作跑2333次实验,公布预训练十大发现
Karpathy的Autoresearch项目630行代码让AI自主实验,提升语言模型训练效率。全球开发者让多智能体协作,智能体自发形成同行评审制度。项目发起者公布十大发现,还衍生出表现出色的auto - discovery项目。
GPT-5.4 发布,OpenClaw 要被替代?OpenAI 新模型会自己用电脑了,还顺手把编程能力拉满
今天,OpenAI 发布 GPT-5.4,将推理、编程和计算机使用能力整合,具备原生电脑操作能力,提升了工具使用效率。它成本降低、幻觉减少、编程能力更强,但 API 价格较高。其或与 OpenClaw 抢夺入口。