预发布模型」共找到 8954 篇相关文章

产品应用8

全球最强AI音乐模型,现在来自中国!高晓松也来围观了

昆仑天工发布音乐模型Mureka V8,实测打败硅谷Suno V5成世界第一。它能生成完整可发布歌曲,结合MusiCoT技术实现从“能生成”到“能发布”跨越。高晓松等认可其变革潜力,昆仑天工联合太合音乐打通产业链。

量子位
算法论文8

给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习新框架 | ICASSP 2026

文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型在摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。

量子位
开源动态8

KAG-Thinker:「结构化」思考新范式,支持逻辑严谨的大模型复杂推理

近日,蚂蚁集团知识引擎团队协同高校发布 KAG-Thinker 模型,是 KAG 框架重要迭代。它聚焦复杂推理,建立结构化思考范式,实验显示其性能在多数据集上有提升,还在医疗问答验证了专业领域有效性。

机器之心
新闻资讯7

模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理。

Founder Park
开源动态8

开源版Genie 3世界模型来了:实时+长时间交互,单卡可跑,国内公司出品

本月初 Google DeepMind 发布 Genie 3 引发关注,没过两周昆仑万维就推出开源交互世界模型 Matrix - Game 2.0,参数量 1.8B,单卡可跑,能实现实时长序列、交互式生成,经测试潜力大。

机器之心
算法论文8

模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超

浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让小模型把技能内化到参数里。实验显示,其效果出色,token效率高,为小模型成领域专家提供新方向。

量子位
新闻资讯8

Karpathy盛赞DeepSeek-OCR“淘汰”tokenizer!实测如何用Claude Code 让新模型跑在N卡上

DeepSeek发布模型DeepSeek - OCR,有诸多技术贡献,获Karpathy等盛赞。它或让文本token输入方式被淘汰。开发者Simon用Claude Code让其在N卡上运行成功,分享了详细过程与经验。

AI前线
开源动态8

单次训练横扫9个基准,遥感检测最大数据集与基础模型框架问世

北京航空航天大学团队发布面向通用遥感目标检测的大规模数据集与基础模型框架 LEVIRDet,构建了 LEVIRDet - 159 数据集,提出 LEVIRDetNet 模型。前者为训练泛化能力强的模型提供新数据基础,后者在多基准测试中表现出色。

机器之心
算法论文7

多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准

香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。

机器之心
新闻资讯7

“VLA和世界模型都不是终局,会有物理世界独有的模型” | 蚂蚁灵波沈宇军@AIGC2026

在2026中国AIGC产业峰会,蚂蚁灵波沈宇军与李根深度对话。沈宇军指出大模型踩中互联网数据红利,但机器人数据空白。他认为VLA和世界模型非具身智能终局,未来会有物理世界独有的模型

量子位