深度研究能力」共找到 5172 篇相关文章

新闻资讯7

GPT-5通过“哥德尔测试”!独创性解决博士生都得花几天时间的开放数学问题

最新论文中,研究人员让GPT - 5挑战5个未解决的优化猜想,它解出3个,还对一题给出不同有效证明方案。测试题需博士水平研究者花几天完成,研究还“挑衅”了陶哲轩对大模型数学能力的印象。

量子位
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
产品应用8

一场对话,我们细扒了下文心大模型背后的技术

信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。

量子位
产品应用8

多模态AI黑马刷榜后再造神器:一个产品搞定图片视频播客生成,自带百种特效,大牛梅涛团队出品

AI大牛梅涛创立的智象未来公司推出vivago2.0(智小象AI),支持图片、视频、播客生成,有上百种特效模板,生图还能自动优化prompt。其依托HiDream - A1,结合HiDream - I1和HiDream - E1能力,团队技术实力强且融资顺利。

量子位
开源动态8

小扎万字檄文炮轰硅谷,Meta重磅开源30B小钢炮!一台MacBook就能跑

Meta发布全新30B大模型Muse Glimmer并开源,用4-bit量化等技术让其能在本地设备运行,有五大核心超能力且采用Apache 2.0协议。同时,Meta CEO小扎发表万字檄文暗讽OpenAI等,抨击AI末日论等观点。

新智元
新闻资讯8

GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026

GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、低延迟推理架构、模型自主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。

AI科技大本营
新闻资讯8

ARR达到3亿美金,Liblib完成近3亿美金融资,估值超20亿美金

近期,演语科技B+轮融资近3亿美元,估值超20亿美元。其ARR达3亿美金,多方面领先同行。该公司跑通PMF,旗下产品有自发传播、用户付费、专业机构接入等优势,LibTV靠系统编排能力切入高价值场景,还筑起生态壁垒。

机器之心
算法论文8

小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型

近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。

深度学习自然语言处理
算法论文8

EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!

近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。

深度学习自然语言处理
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen