多模型集成」共找到 9820 篇相关文章

新闻资讯8

模型中标TOP10里的黑马:中关村科金的应用攻坚之道

2025 年中国大模型产业招投标市场爆发,应用类项目占比近六成。中关村科金以 23 个中标项目入围应用类 TOP10,在行业落地成果显著。2026 年行业将聚焦 ROI、数据壁垒等方面。

机器之心
算法论文8

10倍加速化学推理大模型!Haven团队在隐空间思考分子式,碾压显示CoT

Haven团队提出LatentChem,把化学推理从‘文本表面’挪到‘模型内部’,先在隐空间思考,再在语言空间回答。它拆分‘推理’与‘表达’,性能优异,为AI Scientist奠定基础。

量子位
推荐文章8

我用 AI 翻译的三个阶段:提示词时代 → 推理模型时代 → Agent 时代

作者分享近 2 年 AI 翻译经验,将其分为提示词、推理模型、Agent 三个时代,介绍 Agent 翻译与提示词翻译区别,还阐述 Skill 创建迭代、三种翻译模式由来等,给出解决一致性问题等方法。

宝玉AI
开源动态8

国产免费2B开源语音模型征服《莽撞人》!复刻郭德纲最难贯口

国产免费2B开源语音模型VoxCPM 2,联合OpenBMB开源社区等推出。它能复刻郭德纲《莽撞人》贯口,覆盖九种方言、三十门外语,音质达48000Hz。还可在线体验,有降噪等功能,技术独特且开源工具链完备。

量子位
产品应用8

拯救P图废柴,阿里上新模态模型Qwen-VLo!人人免费可玩

昨夜阿里推出全新模态模型Qwen-VLo,在原有能力上全面升级,有细节捕捉、图像编辑、语言支持等亮点,不受固定格式限制。官方demo展示种玩法,目前免费可玩,实测其编辑能力不错。

量子位
开源动态8

刚刚,全球首个超高帧世界模型诞生!英伟达含量0,狂飙50帧

魔芯科技联合浙大潘云鹤院士团队发布全球首个Flash World Model——MoWorld,全栈基于国产NPU,实现50FPS实时推理,推理成本降70%,为世界模型产业化带来新思路。

新智元
开源动态7

无需租GPU,一台24GB内存的笔记本就够了!

阿里开源稀疏 MoE 模型 Qwen3.6-35B-A3B,总参数 35B,激活 3B。它在智能体编程上超越前代,可与稠密模型媲美,支持模态,已在 Qwen Studio 上线,还能集成第三方编程助手。

GitHubStore
新闻资讯8

刚刚,DeepSeek论文登上Nature,更细节披露!

9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在任务上优于传统模型

PaperAgent
算法论文9

从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步

本文解读了耶鲁、斯坦福等机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。

深度学习自然语言处理
算法论文8

长程任务飙升98%,斯坦福Skill原生LLM来了

普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升模型准确率,且技能熵可复用。

PaperAgent