「大推理模型」共找到 9555 篇相关文章
GPT-Image-2正式发布!设计师可以告别「古法设计」了
OpenAI正式发布ChatGPT Images 2.0(GPT - Image - 2),它是首个具“思考”能力的图像模型,处理复杂任务能力强,实测在商品广告、论文海报等场景表现出色,已全量上线,在大模型竞技中领先。
长程任务飙升98%,斯坦福Skill原生LLM来了
普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升多模型准确率,且技能熵可复用。
刚刚,唐杰、杨强、杨植麟、林俊旸和刚回国的姚顺雨坐一起都聊了啥?
1月10日AGI - Next前沿峰会上,智谱AI唐杰、月之暗面杨植麟等大模型掌舵者及学界泰斗罕见同台。他们探讨AI从‘聊天机器人’进化为‘干活的智能体’,但解法各异,还在圆桌激辩多个敏感话题。
年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川
年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。
沃顿教授警告:老板用AI正偷偷赚钱,而你还在审它做的17份PPT?
AI跨越关键门槛能完成有经济价值的工作,但也可能产生大量无用内容。OpenAI新测试显示大模型进步快,虽暂难取代人类工作,但智能体工作续航能力大增,人类对其使用方式决定未来。
12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看
谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。
arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合
Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流大模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。
奥特曼:假如给我一千倍算力,我会这样做
奥特曼在最新访谈展望下一代模型,认为完美AI是有超人推理能力等的微型模型。理想AGI能自主发现新科学,使全球科学发现提速。他还回应算力假设,为企业指明投入资源方向。
「神经软件」正在到来,人类代码将失去意义!
Lambda Labs CEO Stephen Balaban 在英伟达 GTC 2025 提出神经软件概念,指不再写代码,让大语言模型成软件。它没传统软件的 bug 问题,未来计算机或端到端神经化,虽有争议,但变革在加速。
一个超级搜索Agent开源,超低成本拉满搜索推理能力!小参数、慢思考。
MiroThinker 1.5发布,打响2026年AI模型进步第一枪。它以小参数实现高性能,解决信息雾霾、AI幻觉、决策无力等问题,通过交互式扩展和时序敏感训练沙盒技术,展现强大搜索推理能力。