多步推理」共找到 5589 篇相关文章

产品应用8

国内首次!8.9毫秒推理速度破纪录,1元打穿百万token

在2025人工智能计算大会上,浪潮信息发布元脑SD200和元脑HC1000两款AI服务器。前者让DeepSeek R1的Token生成速度达8.9毫秒,后者将推理成本降至1元/百万Token,解决了AI智能体速度与成本难题。

新智元
产品应用7

Fable 5 刚被封杀,OpenRouter 用「模型协作」搞出了「平替天团」

2026年6月14日,OpenRouter推出复合模型Fusion API,可复刻Claude Fable 5智力水平。它采用模型协作,经DRACO测试效果出色,成本减半,但也有编程不实用、速度慢、数据合规存黑箱等问题,重塑了AI行业逻辑。

AI科技评论
算法论文8

扩散LLM推理新范式:打破生成长度限制,实现动态自适应调节

随着扩散大语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文大学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率上有提升。

机器之心
新闻资讯7

个编码智能体同时使用会不会混乱?海外开发者热议

AI编程工具进快,GPT - 5等模型推动开发自动化。编码智能体成开发常态,但存在问题。独立开源开发者Simon Willison分享并行使用个编码智能体经验,引发海外开发者热议。

机器之心
算法论文8

西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速

扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。

量子位
算法论文8

极简RL新范式:一半算力刷新1.5B模型推理SOTA

过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。

深度学习自然语言处理
算法论文8

「有望成为Transformer杀手」,谷歌DeepMind新架构MoR实现两倍推理速度

谷歌DeepMind发布新架构MoR,有望成Transformer杀手。它统一实现参数共享、自适应计算,兼顾性能与效率。实验显示其推理吞吐量提升,降低计算需求,但能否取代Transformer存疑。

机器之心
算法论文8

AI读不懂文档结构?计算所重构Agentic RAG文档推理能力

大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在数据集验证效果显著。

新智元
开源动态8

1w颗星!平台 LL M 聊天机器人及开发框架AstrBot!

AstrBot是聊天机器人及开发框架,松耦合、异,支持消息平台部署。它功能丰富,支持种大语言模型,有Agent能力、插件扩展等,还介绍了种部署方式、平台及提供商支持情况。

GitHubStore
算法论文8

DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨

全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区