大模型开源」共找到 10195 篇相关文章

新闻资讯8

100个产品原型同时跑、新模型Mythos断层领先,连skills效果都好到让团队意外:Anthropic内部到底在发生什么?

Claude Cowork 工程负责人 Felix Rieseberg 在播客中透露,未发布的新模型 Mythos Preview 带来“断层式跃迁”,在安全漏洞检测等方面表现出色。Anthropic 内部可同时跑上百个产品原型,执行成本降低。还介绍了 Cowork 开发、应用及产品打造经验。

InfoQ
新闻资讯7

GPT-5编程测评反转!表面不及格,实际63.1%的任务没交卷,全算上成绩比Claude高一倍

Scale AI的新软件工程基准SWE - BENCH PRO测试中,‘御三家’表面解决率低。深入看,GPT - 5已提交任务准确率比Claude高一倍。该基准新题多、更复杂,能真实考验模型能力,当前模型解决商业问题能力有限。

量子位
新闻资讯8

刚刚,DeepSeek梁文锋入选Nature年度十人物!被称为「科技颠覆者」

《自然》评出2025年度十科学人物,DeepSeek梁文锋入选,被称为「科技颠覆者」。他的公司发布的R1模型功能强、价格低廉,训练成本低,还开放权重,为研究者提供经验,其成果已融入国人生活。

新智元
新闻资讯8

在 AI「囤粮潮」里,拆解智谱 50 亿美元的「技术账本」

AI行业进入下半场,竞争重心转向持续迭代能力,本文围绕智谱50亿美元融资事件,拆解其资金投向与技术布局,分析头部模型厂商的竞争逻辑。

AI科技评论
算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约学新算法让视觉语言模型更小、更快、更准确

纽约学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
新闻资讯8

刚刚,新一届ACM博士论文奖正式公布

近日,新一届 ACM 博士论文奖公布,含一个博士论文奖和两个荣誉提名。获奖论文探讨人机协作解决心理健康问题,荣誉提名论文分别聚焦计算模型局限性及模型数据利用。

机器之心
新闻资讯8

AI Spot 学术分享会丨ICLR 2026 深度推理专场

模型走向深度推理,ICLR 2026 汇聚全球顶尖成果。OpenMMLab 等联合发起 AI Spot ICLR 2026 学术分享会,5 月 14 日 19 点直播,聚焦模型‘慢思考’,嘉宾将解读四核心技术。

OpenMMLab
产品应用7

Cursor自研新模型反超Opus 4.6,价格还“打一折”!网友实测:只有它写完应用能一次跑通

Cursor发布第二代编程模型Composer 2.0,在关键编程基准测试上反超Claude旗舰模型Opus 4.6,价格还“打一折”。网友实测其写完应用能一次跑通,效率和成本优势明显。但Cursor面临代码编辑器地位下降的危机,正积极自救。

AI前线
8

国产GPU组了个开源局,把SGLang等核心开发者都摇来了!

国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。

量子位
算法论文8

免训练加速61倍!陈怡然团队新作DPad:仅关注「彩票token」

杜克学陈怡然团队新作DPad,发现扩散语言模型关注少量「中奖」token,推理速度可提61 - 97倍,还增强模型语境学习能力。DPad免训练零成本挑关键信息,实现「少算多准」。

新智元