「多Agent编排」共找到 6082 篇相关文章
大部分token根本不该重复计算,不止于KVCache
斯坦福研究显示,AI Agent每次调用62%内容重复,现有前缀缓存虽有优化但天花板低,阿里云数据表明多数缓存块利用率低。LMCache将缓存管理独立,解决性能问题,其CacheBlend技术复用缓存,适配多引擎和存储后端。
模型的自我进化,可能真的开始了。
昨天Hermes Agent更新支持原生Windows,安装简单。它调用量超OpenClaw成榜首,与MiniMax M2.7组合迭代快,能长程干活、自主迭代解bug,还可复刻文档风格样式,两团队正合作后训练项目。
LeCun新公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙
图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃大模型路线,转向联合嵌入预测架构,为通用人工智能提供新解法,还将落地多领域,且承诺开源研究。
清华新框架让大模型学会「精读略读」!实现12倍端到端加速,基准评分翻倍
清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍端到端加速,为长上下文LLM部署提供新范式。
从显式CoT到隐式CoT:复旦让AI告别啰嗦,实现大模型高效沉默推理
复旦大学等机构团队论文提出SIM - CoT技术,解决隐式思维链推理准确率低、不稳定问题。该技术引入步骤级监督,提升性能、效率和可解释性,在多模型和任务测试中表现出色,让大模型高效沉默推理。
吴晓波:“AI闪耀中国”2025(年度演讲全文)
吴晓波在“AI 闪耀中国 2025”演讲中,深入 65 家企业产业现场,勾勒 AI 落地中国图景。指出中美在 AI 领域形成竞赛格局,2025 年是智能体元年,还阐述了 AI 在多领域的应用及对创业的影响。
Claude Opus 4.5 发布,我又把 Claude Max 续回来了
Claude Opus 4.5发布,价格相比Opus 4.1暴跌至1/3,收获全面好评。作者又续了Claude Max,还分享了几个Coding Agent使用感受,最后发布招人信息。
9 个加速开发者生产力的开源 AI 与 MCP 项目
Github官方精选9个开源项目,分框架与平台集成、开发者体验及AI增强编码、自动化与测试编排三大主题。各项目聚焦不同功能,如将MCP嵌入框架、语义理解辅助编码、安全执行调试等,能加速开发者生产力。
什么都不做就能得分?智能体基准测试出现大问题
随着AI智能体走向实际应用,其基准测试变得至关重要。但现有基准测试问题多,如WebArena判错答案、τ - bench给无操作智能体高正确率。文章提出有效性判据和ABC清单,还揭示主流基准测试诸多问题。
何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升
何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。