双模式推理」共找到 2625 篇相关文章

算法论文8

SentGraph:一句一句把多跳RAG“画”成图

传统RAG在多跳场景易‘断链’,因检索单元太胖、逻辑关系乱。SentGraph把检索单元缩到句,按逻辑画三层图。线下建图分拆句、找关系、架桥梁;线上推理有Anchor初选、精炼及路径扩展。实验提升显著,也有局限。

PaperAgent
新闻资讯8

图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子

本文是对图灵奖得主杨立昆的访谈,他批判当前大语言模型局限性,指出难以靠扩大规模达人类水平AI。还强调理解世界需非生成架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。

AI科技大本营
开源动态8

阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体新纪元

阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。

AIGC开放社区
新闻资讯8

梁文锋执笔的R1论文登上Nature封面!首次回应外界三大质疑

9月17日,DeepSeek创始人梁文锋通讯作者名义发表的DeepSeek - R1论文登《自然》封面。该模型借助强化学习自主形成推理能力,在Hugging Face下载量破1090万次。新版论文回应质疑,披露训练细节,虽有不足但引发学界关注。

InfoQ
开源动态7

月之暗面硬刚Anthropic!开源万亿参数Kimi K2,Agent编码性能直逼闭源最强!

上周五月之暗面发布并开源万亿参数Kimi K2,外网评价高。它或开启开源AI的“Agentic时代”,在智能体和编码基准上表现出色,成本远低于竞品,但推理速度较慢,已可平替Claude。

探索AGI
产品应用7

测评豆包1.6:我用它开发了一个“聪明的旅行策划Agent”

作者对豆包1.6进行测评,用其构建旅行策划Agent。豆包1.6推理强、有自适应思考模且计价创新。作者实操构建旅行Agent,结合MCP完成任务,虽有不足但超预期,国内Agent开发生态已成熟。

花叔
新闻资讯7

Cursor只排第6!136国用户实测25款AI编码工具,第一名73%胜率,还是个新面孔

Design Arena评测平台用对抗评测方法,让用户对AI模型生成的设计作品投票,评估其设计美学表现。文章总结了上榜的编码工具,如new.website胜率约73%排第一,还对比了不同类型模型的排名情况。

AI进修生
开源动态8

DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍

DeepSeek正上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练量大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。

新智元
新闻资讯8

GPT‑5深夜发布:模型之战结束,Agent之战开始!

昨晚,炒作一月的GPT - 5正发布,标志原生Agent时代到来。体验显示其压低幻觉、提升指令遵循与推理能力。文中还对比了GPT - 5、Gemini、Claude等模型在不同场景表现,指出御三家路线分化及三条反常识判断。

探索AGI
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。

机器之心