AI推理能力」共找到 12022 篇相关文章

开源动态8

超越O4-mini,多模态大模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态大模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
新闻资讯7

Meta 重金抢人,明星云集就能复制 DeepSeek 的成功吗?

Meta 扎克伯格亲自出手重金招人,组建豪华 AI 战队,核心领导与技术阵容都很强大。但天才招聘只是第一步,组织天才协同才关键。DeepSeek 团队规模小、扁平化,成功逆袭。Meta 难复制其成功,组织重构能力或更重要。

AI科技评论
产品应用8

谷歌最强具身大脑发布!波士顿机器狗瞬间人模人样

Google DeepMind发布机器人推理模型Gemini Robotics - ER 1.6,搭载它的波士顿动力机器狗能精确读仪表数字。该模型是第三代,在空间推理等方面显著提升,还新增读仪表能力,且是谷歌迄今最安全的机器人模型。

量子位
新闻资讯7

DeepSeek新大招曝光:下一步智能体

知情人士爆料,DeepSeek正开发有更强AI Agent能力的新模型,预计年底推出。此前DeepSeek-V3.1已具备更强Agent能力,在工具使用与智能体任务中表现提升。业内对其入局智能体看法不一。

量子位
产品应用7

Codex 和 Claude Code,用哪个?

文章探讨 Codex 和 Claude Code 的使用,建议有条件用最好的模型工具。介绍二者特点,给出文件同步、记忆文件更新、项目目录结构添加等使用方法,还强调写好 Prompt 及明确 AI 能力边界的重要性。

AGI Hunt
产品应用8

字节扣子空间上新一键转播客功能,现在我们真成同事了|甲子光年

5月27日,字节跳动旗下AI协同办公平台扣子空间新增播客功能。其播客音频生成功能让AI从‘说什么’跨越到‘怎么说’,适用于多场景。扣子空间还具备跨模态协作等能力,引入MCP协议,免费开放核心功能。

甲子光年
新闻资讯7

烧3万亿美元实现ASI,把自己优化掉:这是硅谷CEO们的新赌注

硅谷大佬热衷预言AI接管公司,皮查伊称CEO工作AI易胜任,奥特曼想让OpenAIAI掌管。但当下技术连自动售货机都难经营好,科技巨头豪掷3万亿,纳德拉却认为AI难掌管公司。

新智元
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
开源动态8

1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?

过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典型Demo及横向评测。

开源星探
算法论文8

逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%

Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。

AIGC开放社区