「通用推理模型」共找到 8478 篇相关文章

新闻资讯8

超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官

5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。

AI科技大本营
新闻资讯7

把 RAG 做成主流的公司,现在开始“做空”RAG 了

Pinecone 曾将 RAG 定义成大语言模型 grounding 标准范式,如今却宣布 RAG 时代结束。它推出面向 Agent 的知识引擎 Nexus,提出“知识编译”概念,称能提高任务完成率、降低 token 开销,整个 AI 世界都在将“推理”往上游移动。

AI前线
推荐文章8

骂谷歌干蠢事、炮轰甲骨文、AI在真实数据库测试得分为0!83岁图灵奖数据库教父的硅谷“狂人日记”

本文是对图灵奖得主、Postgres 奠基者 Mike Stonebraker 的访谈。他直言大模型 Text - to - SQL 在真实数据库测试得分低,批评谷歌、甲骨文等公司做法,还探讨数据库未来,如 Agent 读写与数据库结合、DBOS 技术等。

AI科技大本营
算法论文8

唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力

大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。

机器之心
算法论文8

机器人「看片」自学新技能:NovaFlow从生成视频中提取动作流,实现零样本操控

布朗大学和机器人与人工智能研究所团队提出 NovaFlow 框架,利用视频生成模型常识知识,让机器人“看片”自学。它将任务理解与控制解耦,通过生成视频提取动作流,实现零样本操控,为通用机器人提供新路径。

机器之心
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
算法论文8

61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径

上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。

AI科技评论
产品应用8

5小时通关《原神》主线!Lumine:AI玩家正式登场

Lumine能像人类一样理解游戏画面、推理并操作,以接近人类效率5小时通关《原神》蒙德主线,还能零训练玩《鸣潮》等。它是开放式研发方案,靠少量数据和显卡让模型成强大智能体。

带你学AI
新闻资讯8

百度CTO王海峰:AGI曙光已现,Scaling Law仍有效|新智元十周年峰会

新智元十周年峰会,百度CTO王海峰分享AI发展。回顾十年,从AlphaGo到如今大模型爆发,AGI曙光已现。他指出AI具通用性和全面性,百度内部超45%新增代码由AI生成,Scaling Law仍有效。

新智元
推荐文章7

2025小结:从RL到Agentic RL

作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。

深度学习自然语言处理