「AI团队」共找到 11604 篇相关文章
复杂的Harness Evolution,甚至不如多跑几遍
本文解读AI2与华盛顿大学最新研究,针对热门Agent Harness Evolution方向,通过公平对照实验检验方法真实收益,戳破研究误区,引发对Agent评估标准的反思。
蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
Agent = Model + Harness,一个可能成为2026年出圈的新概念
文章提出新概念Harnesses Engineering,认为Agent = Model + Harness,阐述了Harness的作用、核心组件,还提及模型训练与Harness设计的耦合及Harness工程未来,指出需‘Harness思维’让AI驱动工业革命。
OpenClaw太麻烦?没关系,你有这个项目可以一斑窥豹!
nanobot是受Clawdbot启发的超轻量级个人AI助手,仅约4000行代码,比Clawdbot小99%,有核心功能。它代码清晰、资源占用少、易部署,还介绍了安装、使用、配置等内容。
Claude Code 更长更快!Agent能自己管项目了!从 Todo 升级到 Task
上周Claude Code团队更新任务清单系统,从「记事本」升级为「项目管理系统」。因模型能力增强,需求变复杂,原TodoWrite无法满足,新Task系统解决了任务依赖协调问题,支持复杂项目。
国内首篇!融合语言模型的多模态触觉传感器,推动机器人触觉迈向人类水平
清华大学丁文伯团队联合多机构,受鸽子感知机制启发研发仿生多模态触觉传感器 SuperTac,构建 8.5B 参数触觉语言模型 DOVE,成果发表于《Nature Sensors》,推动机器人触觉迈向人类水平。
刚刚,Anthropic紧急换帅!新任CTO执掌算力命脉,直面OpenAI千亿赌局
Anthropic宣布任命前Stripe CTO Rahul Patil为新任CTO,原CTO Sam McCandlish转任首席架构师。此次换帅是为强化AI基础设施,应对Claude产品压力及OpenAI、Meta的竞争。
安全噩梦:Docker 警告 MCP 工具链中存在的风险
Docker 发文警告,基于 MCP 构建的 AI 开发工具存在安全漏洞,如凭证泄露、代码执行等。MCP 协议发展快但部分实现有隐患,Docker 分析发现诸多漏洞,还提出强化方法应对。
在 OpenClaw 的冲击下,Cursor 已经要过时了
Insight Partners 联合创始人 Jerry Murdock 接受访谈,认为自主 Agent 是 AI 浪潮核心,Cursor 已过时。还提到会有自主 Agent 专属技术栈,软件未来将由 Agent 购买,劳动力市场会受冲击,现在是创办新基金的最佳时机。
RL训练一层就够了!单层RL超越全参数训练,跨任务跨模型跨算法全部验证
明尼苏达大学、北大和亚马逊团队研究发现,RL收益集中在中间层,训练单层可超全参数训练。他们提出层贡献度指标,经多模型、算法、任务实验验证,还给出三种训练优化策略。