「安全沙箱」共找到 2008 篇相关文章
互联网已死,Agent 永生
文章指出互联网时代诸多概念如DAU、SaaS等已过时,因旧前提‘人是软件用户’改变,新前提是‘Agent是软件新主人’。还阐述Agent时代四块基石,如Token是特权、Agent是人口红利等,强调新旧世界差异大。
智能必须基于世界模型?我们和蚂蚁灵波团队聊了聊
上周图灵奖得主 Yann LeCun 认为真正的智能应能在脑海推演,而大语言模型难以触及真实世界。2026 年初,蚂蚁灵波连续四天开源四款具身智能模型,探索从物理交互构建智能的新路径。
Clawdbot作者:亿万富豪本豪,复出只因退休太空虚
火爆全网的Clawdbot作者是亿万富翁彼得。他2011年创业,2021年套现1亿欧元退休,四年后因空虚复出,2026年推出Clawdbot,这是7x24小时开源AI助理,功能强大。
刚刚,Anthropic 发布 Claude「宪法」:一份写给 AI 的人生指南
Anthropic 公开给 Claude 写的数万字「宪法」,从「规则清单」升级为「价值体系」,设定四个核心价值,有「聪明朋友」理论,设硬性限制,对诚实要求严格,还探讨意识等问题,强调透明度和持续进化。
清华Nature发布惊人结论:AI写论文3倍速,但科学边界被锁死
2026年1月,清华徐丰力、李勇教授联合芝加哥大学团队在《Nature》发文,分析4100余万篇论文发现,AI提升科学家个人生产力,但收缩科学探索集体疆域。团队提出「全流程科研智能体系统」破局。
告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场
过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。
Anthropic 再发长文:首次详细揭秘Agent的评估全过程「Claude code开发过程的经验总结」
Anthropic在Claude Code等开发及与客户合作中总结出AI Agent评估方法。文章介绍评估基本结构、构建原因、评分器类型、不同Agent评估法、应对不确定性指标、构建路线图及与其他方法协同方式。
让欧美老外彻底“真香”,这家中国割草机器人品牌正在定义一个行业新标准
在CES 2026上,未岚大陆发布割草机器人五大新品,呈现“Navimow标准”体系。其新品实现免部署自动建图,用EFLS™ LiDAR⁺三重融合定位系统应对复杂环境,以Xero - Turn™方案解决伤草问题,定义行业新标准。
Zero-RAG,对冗余知识说“不”
文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。
小说一键转有声剧!豆包语音团队提出「AI多人有声剧」方案,沉浸感拉满了
豆包语音团队发布「AI 多人有声剧」自动化方案,基于多角色 Seed - TTS - 2.0 模型,实现从小说文本到有声剧成品端到端 AI 制作,成本和周期大降,首批有声剧已在番茄小说 App 上线。