大模型数据」共找到 9982 篇相关文章

开源动态8

联手字节:开源规模指令跟随视频编辑数据集OpenVE-3M

浙江学与字节跳动合作,提出规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型

机器之心
推荐文章8

推荐系统进入“模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地

文章基于华为郭威在2025 AICon会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
新闻资讯7

最新外国「自研」模型,都是套壳国产?

本周,Cursor发布新代码模型Composer,Cognition推出新AI模型SWE - 1.5,二者均被指背后基于中国AI模型。业界佬认为有证据指向中国开源模型,国产开源模型已成AI领域主流,改变全球竞争格局。

机器之心
开源动态8

超低延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超低延迟等优势。

开源星探
算法论文8

逐个token太慢!模型原生并行出token,CMU、英伟达新作Multiverse

卡耐基梅隆学(CMU)和英伟达研究者提出Multiverse,这是能实现原生并行生成的新型生成模型。它解决了现有并行生成模型缺乏连贯性等问题,通过多方面协同设计构建推理模型,还开源了生态系统。

机器之心
新闻资讯8

从MiniMax到DeepSeek:为何头部模型都在押注「交错思维」?

昨日推特博主公布国内几开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。

机器之心
算法论文8

精准调控模型生成与推理!浙&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位
推荐文章8

揭秘模型Steering:从底层机理到系统评估,全面破解模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心
算法论文8

CMAME | 西安交通学海春龙、梅立泉等:基于分层神经网络的在线多保真度数据融合

在工业应用中,高保真数据获取成本高,低保真数据准确性不足。本文提出基于分层神经网络的在线多保真度数据融合方法(OMA - HNN),含MA - HNN和在线渐进采样框架,经测试验证了其有效性和实用性。

力学与人工智能
开源动态8

6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗模型发布

由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。

AIGC开放社区