Reasoning新范式」共找到 4085 篇相关文章

产品应用7

高考数学全卷重赛!一道题难倒所有大模型,选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,元学习框架解构训练过程,还给优化提供思路

上海AI Lab团队提出RaML框架,从梯度下降和元学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供思路。

量子位
开源动态8

AI4S设计的抗生素通过湿实验!双层思考+多目标优化,主动发现「代谢不稳」并加约束

SAGA是AI,采用双层思考机制,能主动审视需求、优化目标函数。在抗生素、纳米抗体等5大领域湿实验中表现出色,结果获科学家肯定,相关代码已开源。

量子位
产品应用8

锁死一致性!Vidu Q2「参考生」可算来了,功能强到离谱,APP全面进化

生数科技Vidu Q2「参考生」功能全球正式上线,APP端全面改版。上线「视频延长」功能,最长扩展5分钟,还在一致性、速度、成本等方面优化,在镜头语言、语义理解等表现出色,APP社交体验好。

新智元
产品应用8

面壁MiniCPM-V4.5王炸!8B手机10FPS长视频秒懂,文档手写全能识别!

面壁上最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。

CourseAI
产品应用7

OpenAI模型gpt-oss-120b怎么样?三大场景实测首发(对比GLM-4.5-Air)

OpenAI发布开源模型gpt-oss-120b,时隔6年再推开源权重语言模型,给LLM开源生态增添变数。作者实测它在三大场景的表现,并与GLM-4.5-Air对比,认为其距开源SOTA有距离。

花叔
推荐文章8

多模态大语言模型的核心技术架构与训练方法的进化

文章深入剖析多模态大语言模型核心技术架构与训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径与代表模型,还提及国内模型创及开源模型OpenVLA。

AIGC开放社区
新闻资讯8

OpenAI发布模型硬刚Anthropic!Claude Code刚火,就被GPT-5-Codex拍在沙滩上?

9月15日,OpenAI推出模型GPT - 5 - Codex,是微调的GPT - 5变体,用于AI辅助编程。它增强了代码审查功能,能动态调整思考时间,在多项基准测试中表现优于GPT - 5,发布后引发网络热议,AI编码工具市场竞争激烈。

AI前线
新闻资讯7

曾让 Adobe 豪掷千亿,如今要独立上市了!招股书疯狂点名 AI 150 次,产品对标 Lovable

网页设计工具开发商 Figma 申请 IPO,招股书提“AI”超 150 次,既视其为“创意加速器”,也认为是“潜在威胁”。该公司业务增长强劲,今年扩展工具库,虽 AI 投入短期内有负面影响,但仍会加倍投入。

AI前线
新闻资讯7

稚晖君最188机器人,阅后即焚

具身智能机器人正火,上纬材原本做复合材料,被稚晖君联合创办的智元机器人拿下控股权。智元上纬发布两张机器人图,上纬材股价涨停,后文章被删。目前其机器人业务未量产、无营收,收购过程历时四个月完成。

量子位