中国大模型」共找到 9572 篇相关文章

开源动态8

微软开源3突破AI Agent模型,仅140亿参数超越DeepSeek-R1

微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三突破,显著提升性能且降低算力成本。

AIGC开放社区
新闻资讯7

英伟达中国一把手造国产GPU,冲刺IPO了

摩尔线程完成上市辅导,冲刺IPO。其创始团队来自英伟达,创始人张建中深耕GPU近二十年。公司产品丰富,涵盖全功能GPU、模型训推产品、专业和游戏显卡等。同时介绍了燧原和壁仞的上市情况。

量子位
新闻资讯7

思特威、格科微……十厂商亮出传感器“王牌”

在全球半导体竞争与供应链重构下,中国传感器芯片产业机遇与挑战并存。本文精选2025年参评‘芯师爷-硬核芯年度评选活动’的思特威、格科微等十厂商及其产品,展现产业感知层关键突破。

芯师爷
新闻资讯7

爆冷!首届模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰

谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。

新智元
算法论文8

上海交DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型

上海交通学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三关键设计。

机器之心
开源动态8

500行极简开源框架,硬刚GPT/Gemini视觉极限!

多模态模型代码能力进步,但基础视觉任务常失误。UniPat AI构建SWE-Vision框架,让模型用代码处理视觉判断,在五个视觉基准测试达最优,其极简设计有效且泛化性强,代码已开源。

新智元
算法论文8

AI黑化如恶魔附体!LARGO攻心三步,潜意识种子瞬间开花 | NeurIPS 2025

在NeurIPS 2025,哥与罗格斯提出LARGO,它不改提问,直接在模型“潜意识”动手脚,绕过安全防护输出不该说的话。其分三步攻击,成功率高、隐蔽且迁移性强,暴露模型根本性弱点。

新智元
算法论文8

ICCV 2025|降低扩散模型中的时空冗余,上交EEdit实现免训练图像编辑加速

上海交通学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。

机器之心
算法论文8

华为攻克AI推理「想太多」问题!新方法让模型推理提速60%,准确率还高了

华为提出高效推理方法S - GRPO,突破思维链「冗余思考」瓶颈。通过“串行分组 + 衰减奖励”设计,在Qwen3上有效,推理提速60%,生成答案更精确有用,在多个推理benchmark测评中表现出色。

量子位
新闻资讯7

逆天改命!OpenAI 开源模型的安全底裤被 Meta 研究员给扒掉了……

Cornell学兼Meta研究员jack morris成功将OpenAI最新开源的推理专用模型GPT-OSS逆向还原成基础模型,绕过对齐和安全措施,还暴露其训练用量版权材料问题,此成果引发社区激烈讨论。

AGI Hunt