模型自曝」共找到 8218 篇相关文章

算法论文8

何恺明首个语言模型:105M参数,不走GPT回归老路

何恺明团队推出全新连续扩散语言模型ELF,不走GPT回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型

量子位
产品应用7

Cursor模型反超Opus 4.6!价格脚踝斩,氛围编程沸腾了

Cursor新编程模型Composer 2性能超Claude Opus 4.6,价格“脚踝斩”。它靠引入新强化学习方法,让模型学会“做笔记”突破上下文瓶颈,在任务中表现出色,研究员还放出Composer 3消息。

量子位
推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。

InfoQ
开源动态8

百度开源视觉理解模型Qianfan-VL!全尺寸领域增强+全研芯片计算

今天百度智能云千帆推出全新视觉理解模型Qianfan - VL并全面开源,含3B、8B和70B三个版本,基于研昆仑芯P800计算。它特点多、性能优,应用场景广,未来还将推新产业级模型

量子位
算法论文8

SPIRAL:零和游戏对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
产品应用8

李飞飞押注的「世界模型」,中国研Matrix-3D已抢先实现了?

中国研世界模型Matrix-3D可单张图生成3D世界,效果对标李飞飞的World Labs,还能实现更大范围探索。它有诸多优势,技术上有创新,数据集有特点,应用前景广泛。

新智元
算法论文8

扩散模型引导新范式:直接交换token就能变强! | CVPR‘26 Oral

上海交大和vivo研究者提出交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。

量子位
算法论文8

LLM内部竟藏着众多策略模型所&腾讯团队首次揭示大模型RL新机制

中国科学院动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。

PaperAgent
新闻资讯8

神秘具身团队又放出一连串很炸的Demo视频…进化模型,技术路线

神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,体现对物理规则和人类习惯的理解与进化能力。

量子位
算法论文8

微信、清华连续回归模型CALM,新范式实现从「离散词元」到「连续向量」转变

腾讯微信 AI 联合清华提出连续回归语言模型 CALM,它将语言建模为连续向量而非离散词元,显著改善性能与计算成本权衡,解决了 LLM 效率瓶颈,虽面临技术挑战但实验效果佳,还指明未来研究方向。

机器之心