大模型3.0」共找到 9992 篇相关文章

产品应用7

时隔一年,再次使用7个国产AI模型写高考作文,国产模型的进步也太了!有彩蛋。

去年评测国产模型写高考作文能力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型,能力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。

开源AI项目落地
开源动态7

OpenAI突然开源新模型!99.9%的权重是0,新稀疏性方法代替MoE

OpenAI悄悄开源新模型,0.4B参数且99.9%权重为零,是Circuit Sparsity技术的开源实现。该技术通过约束模型内部连接稀疏性,解决传统稠密Transformer黑箱问题,或让MoE模型走上末路,但目前算力成本极高。

量子位
新闻资讯7

美国模型长期霸榜的LMArena,出现了一个国产模型

2025 年底,中美 AI 阵营发展路径有区分,美国多是强模型加工具链,中国在多方面发力。12 月 23 日 LMArena 更新文本榜,百度文心新模型 ERNIE - 5.0 - Preview - 1203 以 1451 分登上榜单,成中国第一且是前 20 名里唯一非美国模型

MacTalk
新闻资讯8

Google重磅上线通用世界模型Genie 3 - 此即未来。

Google发布世界模型Genie 3,它与Sora等AI视频产品本质不同,像可实时演算的模拟器。Genie 3解决了前辈无法调和的矛盾,在交互、时长、控制等方面有突破,虽有局限,但打开新世界门。

数字生命卡兹克
开源动态8

9B“小”模型干了票“”的:性能超8倍参数模型,拿下23项SOTA | 智谱开源

智谱发布并开源仅9B小的模型GLM-4.1V-9B-Thinking,在28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升能力,还获10亿投资。

量子位
算法论文8

ICLR 2026 | ProSafePrune:一剪见效,告别模型过度防御

合肥工业学与科讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。

机器之心
推荐文章8

语言模型的解耦:人工智能基础设施的下一轮进化

人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。

InfoQ
推荐文章8

真正的AI竞争力,藏在模型“后训练”这一步

当全球聚焦基座模型参数竞赛时,后训练变革正悄然发生。产业共识是,模型后训练是AI落地产业必经之路。后训练技术从SFT演进至强化学习范式,企业应用也有了从技术到商业价值的完整链路。

量子位
新闻资讯7

5个疆离职员工,把3D打印带回风口

3D打印再度火热,街头地摊产品畅销,社交平台热度高。拓竹科技由5位疆离职员工创立,其产品X1成绩亮眼,MakerWorld平台以积分制度吸引用户。如今3D打印因性价比、新消费、低门槛等因素升温。

量子位
新闻资讯8

国产「3D版Anthropic」再获数亿融资!60人初创,卡住全球3D脖子

影眸科技完成数亿元新一轮融资,发布全球首个具千万面级生成能力、引入‘先思考、再生成’逻辑的3D模型Hyper3D Rodin Gen - 2.5。其有诸多优势,获多巨头认可,目标是定义空间智能底层规则。

新智元