新推理模型」共找到 9627 篇相关文章

开源动态8

神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡

神秘模型「牛来」真身曝光,是智谱刚开源的 GLM - 5.3 Flash,为 5 系列首个原生多模态模型。它尺寸小能力强、价格低,用国产卡,实测多模态和 Coding 能力出色,架构全,开源后将模型、算力和生态结合。

量子位
算法论文8

AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位
新闻资讯8

奥特曼点评中美AI牌桌:美国猛攻前沿,中国凭“两张王牌”错位竞争

OpenAI CEO 萨姆·奥特曼在贝莱德峰会上指出,从 o1 到 o3 模型,复杂推理成本降 1000 倍,2028 年末数据中心 AI 认知能力或超人类。他还拆解中美 AI 竞争,美国前沿领先,中国旧模型推理成本控制和基建推进有优势。

AI科技大本营
新闻资讯8

谷歌发布最强 AI“全家桶”、一句话就让AI拍大片!这一夜,谷歌Gemini贯穿始终,网友:果然Android“靠边站”了

谷歌在I/O大会推出AI“全家桶”,含Gemini 2.5模型、搜索AI模式等。谷歌已发布十多个模型、20多个重大AI产品与功能,多项数据显示AI发展迅速,还有多项目融入产品,多模态模型升级。

AI科技大本营
算法论文8

RL在Agentic Reasoning中的作用:拨开迷雾,看清本质

近年大语言模型推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
产品应用8

阿里发布一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型

5月20日,阿里发布一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。

InfoQ
开源动态8

刚刚,DeepSeek 突发梁文锋署名论文:V4 架构提前曝光?

今天凌晨,DeepSeek在GitHub开源论文与模块Engram,论文提出“查—算分离”机制,通过可扩展查找记忆结构提升模型表现。Engram将记忆与计算职责分离,或成V4核心技术,获网友肯定。

InfoQ
开源动态8

刚刚,DeepSeek 突发梁文峰署名论文:V4 架构提前曝光?

今天凌晨,DeepSeek在其GitHub官方仓库开源了论文与模块Engram。该论文提出“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下提升模型表现,代码与论文全文均已开源。

AI前线
新闻资讯8

斯坦福教授直播训练535B大模型模型训练背后的「黑箱」正在被打开?

斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去大模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。

机器之心
新闻资讯8

0.027B手机AI模型,估值2亿美金,三个清华学霸如何获得国际大学生创大赛冠军

10月15日,清华万格智能团队“基于类脑架构的下一代通用模型与智能体生态”获中国国际大学生创大赛(2025)冠军。团队由三个清华本科生创立,此前已完成融资,估值达2亿美元。其智人HRM模型有诸多优势,还研发出顶尖气候预测专家模型

AIGC开放社区