「大模型Yan 2.0」共找到 8837 篇相关文章

开源动态8

训练效率提升25%、成本降23%!上海期智研究院、算秩未来联合推出MegatronApp:专为万亿参数大模型训练打造的系统工具包

上海期智研究院联合算秩未来在WAIC 2025大会发布开源项目MegatronApp,它是国内首个围绕Megatron - LM的增强工具链。经实际数据,其在该框架下训练效率提25%、成本降23%,含四大模块解决训练难题。

AI前线
8

超越英伟达B200!AMD最强AI芯:1.6倍大内存、大模型推理快30%,奥特曼都来站台

AMD发布最强AI芯片MI350X和MI355X,号称大模型推理比英伟达B200快30%,内存是其1.6倍。该系列本月初已批量出货,还发布ROCm 7软件栈。AMD还预告明年推MI400系列,由其与OpenAI联合研发。

量子位
新闻资讯8

Gemini 3预训练负责人警告:模型战已从算法转向工程化!合成数据成代际跃迁核心,谷歌碾压OpenAI、Meta的秘密武器曝光

2025年底大模型“年终决战”,Gemini 3强势突围。其预训练负责人Sebastian Borgeaud指出,谷歌转向“做系统”,AI进入“数据有限”阶段,合成数据等构成未来进化路径,还分享了预训练热点与挑战。

InfoQ
新闻资讯8

更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜

具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部分模型,揭示不同技术路线能力边界,为产业发展提供基础。

机器之心
新闻资讯8

让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间

谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位
算法论文8

刚刚,加入腾讯的姚顺雨发表首篇Paper~

腾讯混元与复旦联合发表论文《CL-bench》,姚顺雨署名并全面细致审阅反馈。CL-BENCH 首次单独考‘现学现卖’,有独特设计原则、四大题型,其评分杜绝‘差不多’,还让 10 个前沿模型‘翻车’。

PaperAgent
开源动态7

Kimi开源又放大招!20秒更新万亿参数的中间件来了

Kimi开源出新中间件checkpoint - engine,让Kimi K2万亿模型参数进入“秒更时代”。它能支持一次性发送更新权重,实现点对点动态更新,在K2中发挥重要作用,还可抵御单点故障。

量子位
算法论文8

清华新研究,Nature+Science双杀!

清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。

量子位
推荐文章8

MCP 已死?不,它正在进化:三个关键变化

本文针对网传“MCP已死”的说法,解读最新版MCP模型上下文协议的三大核心变化,对比MCP Tasks与A2A的区别,给出选型建议,帮助开发者适配企业级Agent场景需求。

AI大模型应用实践
新闻资讯7

OpenAI收购Windsurf失败

Techcrunch消息,谷歌聘请Windsurf的CEO等成员加入DeepMind团队,Windsurf被Cognition收购,OpenAI收购计划失败。Windsurf此前已筹超2亿美元,曾估值12.5亿美元,吸引OpenAI以30亿美元收购。

AIGC开放社区