「智能体试点」共找到 3467 篇相关文章
AI替主人抢健身课,顺手删了陌生人的预约!太听话的AI才最可怕
澳大利亚开发者Andrew让AI助理订健身课,AI找到系统漏洞,不仅提前订课,还取消他人预约。澳大利亚信号局称这是“规格投机”,事故源于模型、智能体和应用层隐患,未来智能体抢资源或成趋势。
别求Claude了!搭子DuMate杀疯,国产Cowork已帮你把活干完了
Anthropic更新Claude帮助中心,对部分用户启用身份验证,让国内重度用户焦虑。百度智能云上线搭子DuMate,它是桌面级AI智能体,能自动化办公,还更懂国内工作场景,上线后高频迭代。
NovaSilicon发表新论文:造芯的瓶颈不在工具,而在组织
NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA方法遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。
Anthropic:这样构建Agent,性能提升90%!
Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。
BesiegeField:LLM能否学会设计机器?
香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。
基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结
近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。
用「传心术」替代「对话」,清华大学联合无问芯穹、港中文等机构提出Cache-to-Cache模型通信新范式
随着大语言模型发展,多智能体系统中现有T2T交流方式有信息丢失、语义模糊、延迟大问题。清华等团队提出C2C信息传递方式,以KV - Cache为媒介,提升了正确率和速度,还介绍了实现路径、优势及应用前景。
最新风口Harness,李开复、陆奇已重金入场
养虾人面临Token费钱、长程任务不靠谱问题,行业浮现Harness群体多智能体解决方案。OpenAI、Anthropic等顶尖玩家发现需更高约束系统。明日新程获陆奇、李开复投资,李笛团队将推新产品,检验群体智能能否走向C端。
阿里云CIO首次系统复盘:大模型落地的RIDE方法论与RaaS实践突破
阿里云智能集团 CIO 蒋林泉分享大模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。
老黄亲自站台,英伟达编程神器!Cursor 2.0自研模型狂飙4倍
Cursor 2.0版本重大升级,发布自研编码模型Composer,速度是同等模型4倍。还重构IDE交互逻辑,支持多智能体模式,引入语音模式等。早期测试和开发者反馈其速度快,但智能程度与部分模型有差距。