多步推理」共找到 5589 篇相关文章

开源动态8

首个代码世界模型引爆AI圈,能让智能体学会「真推理」,Meta开源

Meta重组后的AI部门推出首个代码世界模型CWM,是320亿参数开放权重LLM。它与传统大模型思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究。

机器之心
新闻资讯8

性能比肩Gemini 3 Pro!昨晚,阿里千问最强模型来了

1月26日深夜,阿里千问旗舰推理模型Qwen3 - Max - Thinking上线,综合性能对标GPT - 5.2与Gemini 3 Pro。它突破传统推理方式,有自适应工具调用能力,助其在企业级AI竞争中领先。

机器之心
开源动态8

字节突然开源Seed-OSS,512K上下文碾压主流4倍长度!推理能力刷新纪录

字节跳动突发开源360亿参数的Seed-OSS-36B,呼应OpenAI开源策略。它有512K超长上下文,引入“思考预算”机制。项基准测试达开源SOTA,字节Seed团队此前也开源个项目。

量子位
算法论文8

打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26

现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。

量子位
新闻资讯7

国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%

继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队来自 AMD,产品覆盖领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。

AI前线
算法论文7

无需准确传感信号!轻松搞定「段软体机械臂」复杂位姿与形状控制

研究人员提出利用双向循环神经网络(biLSTM)的MSCA规划与控制策略,即便用不准确内部传感信号也能完成任务。实验显示该方法在任务中表现优异,未来还将做进一研究。

新智元
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。

机器之心
开源动态8

DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持

Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有项技术创新,在个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线服务。

AI工程化
推荐文章7

后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定Agent异协同难题

文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异化 Multi - Agent 系统,探讨 Agent 间异通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异系统。

AI科技大本营
开源动态8

国产王炸!上海AI Lab开源Lumina-DiMOO,开创模态理解与生成新范式

上海人工智能实验室等机构推出模态生成与理解统一模型Lumina - DiMOO,采用全离散扩散架构。它解决传统模态架构问题,有全离散扩散建模等四大创新,性能在基准测试中领先,应用前景广。

AIGC开放社区