Model1」共找到 1820 篇相关文章

新闻资讯8

曝梁文锋不满内部会议泄露,DeepSeek或暂停新融资;卡帕西入职Anthropic仅两月疑离职;日媒拆解宇树G1后认输:短期内赶不上中国|AI周报

这篇AI周报涵盖多则热点,如DeepSeek因会议纪要外泄或暂停融资;AI大神Karpathy入职Anthropic两月引离职传闻;美国指控K3蒸馏大模型,黄仁勋等支持开源AI;还有企业人事变动、模型发布及应用等消息。

AI前线
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
算法论文7

SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%

文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。

CourseAI
新闻资讯7

AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退

Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。

新智元
新闻资讯7

好你个智谱,模型价格搞双标:中国一套外国一套

网友发现智谱Max计划国内外价格差异大,中国469元(约68美元),西方160美元,引发热议。Hugging Face产品负责人力挺GLM - 5.1,而Claude被曝性能下滑、成本增加。

量子位
推荐文章7

王云鹤眼中的Harness:复杂优化问题,AGI灵魂争夺之战

王云鹤在知乎文章中探讨Harness Engineering,指出Agent=Model+Harness,多模型配合能提升Agent能力。还分析Harness存在的必要性,认为它是复杂优化问题,关乎AI“灵魂”之争。

机器之心
新闻资讯8

世界模型双冠王诞生!国产世界模型力压谷歌、英伟达等持续领跑

近日,Manifold AI 研发的世界模型 Worldscape 0.2 在 WorldArena 榜单夺冠,此前 WorldScape 0.1 也登顶 WorldScore。该模型参数规模小,进化靠 MoE 架构,展现国产世界模型实力。

机器之心
开源动态8

“DeepSeek 时刻” 一周年

本文回顾 2025 年 1 月 “DeepSeek 时刻” 后中国开源 AI 社区转折,分析其对全球开源生态的重塑。指出 DeepSeek R1 降低三门槛,推动战略转变,全球也积极应对新开源热潮。

Hugging Face
推荐文章8

近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角

宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。

机器之心
新闻资讯8

IBM炸场:人类史上第一颗0.7纳米芯片诞生,指甲盖塞进1000亿晶体管

IBM宣布推出全球首款亚1纳米节点芯片,采用0.7纳米制程。其晶体管密度近乎2021年2纳米芯片两倍,性能或能效显著提升。靠纳米叠层架构实现突破,预计五年内量产。

AI寒武纪