深度研究能力」共找到 5172 篇相关文章

开源动态7

这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!

MiroThinker v1.5开源,其30B小模型在Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。

探索AGI
算法论文8

字节Seed新作:模型合并如何改变大模型预训练范式

字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究

机器之心
新闻资讯8

谢赛宁开炮,现场打脸CVPR评审!Sora开山之作DiT被拒,怒斥AI学术圈畸形

在CVPR 2025上获年轻研究者奖的谢赛宁批判AI学术界畸形,回顾DiT、SiT论文被拒却成Sora等奠基成果的经历。他借“无限游戏”与“有限游戏”概念谈AI研究,指出应坚持“无限游戏”,打破当前困境。

新智元
新闻资讯7

爆冷!首届大模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰

谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力

新智元
产品应用8

这个真人版《火影忍者》竟然是AI做的,来自中国AI视频新王者Vidu Q3

开年国产AI竞争激烈,AI视频生成圈新出全球首个支持16秒音视频直出的Vidu Q3。它能全自动生成,语言支持多语种,经权威认证排名中国第一、全球第二,可实现图生和文生音视频,提升了AI视频生成能力

量子位
推荐文章7

AI竞赛下半场:为什么说“超级工厂”是最优解?

2025年夏天,巨头们因Agent的崛起对AI热情高涨,砸钱堆算力的背后是算力供不应求的困境。云计算因其具备极致的规模化、先进的生产工艺、柔性生产、智能管理和生态链接能力,被认为是AI的“超级工厂”。阿里云作为实例,展示了其完整的AI生产体系。

InfoQ
新闻资讯7

人民想念DeepSeek

文章探讨AI时代Token相关问题。指出其消耗大、价格贵,存储价格上涨使Token降价缺杠杆,虽模型能力提升、MFU优化可降本,但传导到C端取决于商业考量。还回顾大模型价格战,介绍本地部署及芯片创新方案。

芯师爷
新闻资讯7

快来看看GPT-5第一波实测

GPT-5发布引全球关注,50万粉Youtuber Matthew Berman用25分钟视频展示其近30个任务表现,如做出魔方生成器、复刻网页版Word和Excel等。它多项能力有提升,但也有不足,被马斯克质疑,还因‘52>69’名场面遭吐槽。

量子位
产品应用8

银河通用WRC首发英伟达Thor,银河太空舱世界首创城市级机器人应用

全球首个城市级常态化运营的人形机器人示范区落地北京。银河通用具身大模型机器人Galbot依托大模型实现精准商品识别与取送,还展示了多场景应用能力。其银河太空舱开启‘十城百店’计划,推动具身智能服务普及。

新智元
新闻资讯7

估值7亿美元!OpenAI前高管杀进工厂,要给流水线装上AI大脑

2024年硅谷经历OpenAI高管离职潮,前首席研究官Bob McGrew联合创办Arda,将AI带入制造业工厂。Arda以7亿美元估值融资7000万,开发视频模型让机器人自主学习,统筹生产线的人与机器。不过,制造业引入AI面临挑战。

新智元