「工具管控模式」共找到 2863 篇相关文章
Manus 数月憋大招, 100 个 Agent 并发只为选双鞋?肖弘放话:第一阶段就得先做超贵的 AI!
中国人工智能初创公司 Manus 推出新功能“Wide Research”,可让用户借助多个 AI Agent 同时处理大规模任务。该功能不走“深度研究”路径,架构经优化,计算能力扩展 100 倍,但效果待察。Manus 撤出中国市场,欲借此求差异。
就是阻击OpenAI,Claude抢先数十分钟发布Claude Opus 4.1
就在Sam Altman官宣两个开源推理模型前半小时,Anthropic抢先发布新模型Claude Opus 4.1。该模型能力提升,适用多平台,定价公布,企业用户反馈良好,还提供混合推理模式,不过订阅费遭吐槽。
强化学习的两个「大坑」,终于被两篇ICLR论文给解决了
现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。
内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源
据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型。
Gemini 2.5 Pro 是怎么炼成的?-- gemini 2.5 技术报告阅读笔记与思考
文章是 Gemini 2.5 技术报告阅读笔记。介绍其成功点有多模态、LongContext、思考能力;还阐述模型结构、训练和数据情况,以及代码、事实性、长上下文等特定能力的提升,最后提到基于其构建的智能体。
一篇95页最新80种Deep Research系统全面综述
浙大研究深度研究系统领域,分析自2023年以来80多个实现,提出4维度分层分类法,全面剖析4种实现架构,如单体、流水线、多智能体和混合架构,并阐述各维度演变与进步。
开源套壳叫板Google?Perplexity新品发布,印度裔CEO放言5万美金撬走彭博千亿生意
AI搜索公司Perplexity推出Comet浏览器,整合自家AI工具,挑战Google Chrome。其CEO Aravind Srinivas不认同垂直创业路线,获马克·安德森支持。该浏览器底层用Chromium,还想终结Bloomberg,重塑金融研究市场。
研究显示:AI 并没有提升编程效率,它反而让你变慢了19%
METR研究显示,16位资深开发者在真实项目测试中,使用AI工具效率降低19%。分析发现,编写提示词、等待响应等耗时多,保留代码仅44%。研究指出多因素致效率低,网友看法不一。
紧急加薪+全员放假!OpenAI被连挖8人后,真慌了
面对Meta疯狂挖人,OpenAI本周基本停工,员工放假一周,高管继续工作。首席研究官Mark Chen承诺与Meta交锋,反制措施包括调整薪酬等,还表示公司将改变工作节奏,更专注实现AGI。
AgentAuditor: 让智能体安全评估器的精确度达到人类水平
LLM智能体进化为“行动派”,但自主权带来安全问题。现有评估基准缺乏有效精准评估器,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估器精确度达人类水平,为构建可靠智能体提供工具。