样本合成」共找到 388 篇相关文章

算法论文8

香农、信息论、AI、Scaling Law,以及信息的观察者效应

文章围绕经典信息论在AI实践中的矛盾展开,介绍CMU和NYU论文《From Entropy to Epiplexity》提出的新概念,解释合成数据、数据排序等问题,还探讨合成数据飞轮能否持续,指出epiplexity可定义数据质量。

花叔
算法论文8

清华首提通用大模型滤波方法,实现零样本状态估计|NeurIPS'25

清华大学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入大语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型。

新智元
算法论文8

无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!

论文提出RLSC,让大语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。

深度学习自然语言处理
开源动态8

Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统

Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。

AI工程化
开源动态8

腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配

音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景多。

开源星探
推荐文章7

这波AI淘金热里,卖“铲子”的公司正闷声发财,“征服"了几十家国内外巨头!

光轮智能联合创始人杨海波表示,AI发展让合成数据需求增大。该公司为具身智能行业提供3D合成数据,服务众多头部企业。其优势在于技术视野与路径独特,强调物理交互、人类示范等。还谈及创业要点与AI赛道变化。

AI前线
算法论文8

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。

量子位
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智能”潜力。

量子位
产品应用8

首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还能互相0样本迁移技能

谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,能跨机器人迁移技能。

量子位
算法论文8

让机器人学会手往哪儿伸、怎么操作,东大团队给了新解法

东南大学魏秀参团队提出 RAAP 解决具身智能领域可供性预测难题。它将 affordance 分解,设计互补推理机制,每任务仅需数十样本,已被 ICRA 2026 接收,实验显示其性能优于基线。

机器之心