多步推理」共找到 5589 篇相关文章

新闻资讯8

小米罗福莉:MiMo-V2.5如何做到又快又强又便宜? | ICML 2026

2026年7月ICML大会上,小米MiMo团队负责人罗福莉介绍MiMo - V2.5系列。该系列跳出传统思路,从架构、训练、推理协同设计,实现“聪明、快速、便宜”,如预训练降成本、后训练有硬核算法、推理加速达1000 TPS。

AI科技评论
新闻资讯7

谷歌Deep Think八语奥赛屠榜!自主攻克4大未解难题,科研壁垒崩塌

谷歌Deep Think横扫亚欧语种竞赛,成绩亮眼。虽评测数据来自内部,未公开细节且是区域赛,但它定位为‘人类智力倍增器’,其驱动的Aletheia已产出论文,解决4个未解问题,在领域展现潜力。

新智元
新闻资讯7

Win11 已近乎“残废”?微软承认个核心功能崩盘,锅要甩给 AI 编程吗?

近期微软麻烦不断,先是部分Microsoft 365服务故障,Windows业务负责人公布的计划也遭不满。英伟达指出Windows 11更新影响游戏效能,微软承认其存在系统性问题,个核心功能故障已持续四个月,官方正修复并给出临时方案,引发社区吐槽。

InfoQ
新闻资讯7

GPT-5准确率不足40%!北大发布模态、高难度化学基准SUPERChem

北大团队发布模态、高难度化学基准SUPERChem,构建评估大语言模型化学推理能力新体系。测试显示,GPT - 5准确率仅38.5%,与低年级本科生相当,且模型在高阶推理有短板,该基准为模型优化指明方向。

新智元
产品应用7

AI陪伴Top 1应用上线视频生成!图片人物能说话唱歌,轮对话场景依然稳定

AI陪伴应用Top 1的Character.ai(c.ai)上线视频生成功能AvatarFX,可让静态图片人物“开口说话”。c.ai还上新项AI创作功能。此外,谷歌收购c.ai遭美国反垄断调查。

量子位
产品应用8

4K-Agent:可将低分辨率图像提升至4K高清智能体

图像超分辨率技术在种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其智能体架构能将低分辨率图像提至4K高清,在领域测试表现出色。

AIGC开放社区
新闻资讯8

Jeff Dean最新访谈:基础模型越来越强,小团队如何与谷歌等巨头竞争?

Jeff Dean 在 Y Combinator 活动中与 Diana Hu 对谈,探讨 AI 创业者面临的问题。他指出推理成新瓶颈,预计有更推理硬件;Agent 执行复杂任务进快;小团队可找 1%成功率问题;还提及稀缺能力及创业建议。

DeepTech深科技
开源动态8

CVPR 2026 | 1B模型也能当镜头导演?大连理工&快手可灵开源力作MultiShotMaster

大连理工与快手可灵团队推出MultiShotMaster框架,能在1B左右小参数量级模型实现导演级镜头调度和连贯叙事,支持图参考、主体运动控制。论文录用至CVPR 2026,代码已开源,还获AAAI CVM Workshop竞赛冠军。

机器之心
开源动态8

抖音&LV-NUS开源模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出模态大模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在数据集验证中表现卓越。

量子位
算法论文8

「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也能「明察秋毫」!

上海交通大学与蚂蚁集团联合团队发布模态大模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型单次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性能。

AI科技评论