多Agent并行推理」共找到 4601 篇相关文章

产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.27B参数硬刚思维链模型,推理完爆o3-mini-high

新加坡Sapient Intelligence推出小参数AI模型HRM,能解决复杂推理难题。它受大脑启发,提出“隐性推理”路径,准确率碾压先进思维链模型,推理能力超越o3 - mini - high,经济性突出,任务效率可百倍提升。

AI前线
推荐文章8

Agent项目最头疼的不是技术,这可能是近期最棒的Agent调研。

MMC深入访谈多家AI Agent创业公司创始人和企业用户,撰写《State of Agentic AI: Founder’s edition》。调研显示创始人头疼的多是非技术问题,还分析了准确率与主动性、定价策略等情况。

探索AGI
算法论文8

微软 Agentic 组织:下一代 AI 系统

微软研究院提出全新推理范式AsyncThink,让LLM从单打独斗进化成带团队的项目经理。它把并发控制转为纯文本协议,经两阶段训练,实验中全方位碾压传统方法,还具跨领域泛化能力。

PaperAgent
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
算法论文7

The Batch: 899 | 更划算的推理

研究人员提出 Delethink 强化学习方法,训练大模型定期截断推理 token 至固定最大数量,以限制处理长思维链成本。经测试该模型在多方面超基线,且缓解计算成本限制,为长上下文推理提供路径。

DeeplearningAI
产品应用8

文库 GenFlow2.0,这个特性让我大吃一惊

作者作为创业者和 Agent 重度用户,分享了使用文库 GenFlow2.0 的体验。它是全球首个全端通用 Agent,支持多 Agent 并行工作,过程可干预,整合多维生态,交付形态接近专业生产工具,还支持 MCP 协议开放能力。

MacTalk
开源动态7

如何重现 DeepSeek 推理性能突破

DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。

InfoQ
新闻资讯7

Anthropic发布Agent SDK,截胡 OpenAI

OpenAI Agent Builder消息传开,大家等其Dev Day发布时,Anthropic突然宣布将Claude Code SDK改名Claude Agent SDK,抢先发布完整智能体开发框架。该SDK有独特理念、工作流程及多种功能,与OpenAI产品理念不同。

AI工程化
开源动态8

10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题

推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。

量子位
新闻资讯7

云厂商「进击」 Agent 开发平台

企业级智能体(Agent)市场崛起重构云服务竞争格局,云厂商需提供全栈能力。腾讯云宣布智能体开发平台3.0上线,优图实验室关键技术持续开源。文中还分析企业开发Agent难题及腾讯云应对举措。

AI科技评论