「多模态数据融合」共找到 3531 篇相关文章
Index-AniSora:B站开源动画生成模型,斩获多项SOTA入选IJCAI25
B站开源动画视频生成模型Index - AniSora,支持多种二次元风格视频镜头一键生成。基于AniSora系统,全面提升动画生产效率与质量,开源内容丰富,还构建奖励数据集和奖励模型提升对齐性能。
刚刚,何恺明团队新作,「嵌入式语言流」ELF来了
何恺明团队提出ELF模型,将扩散过程置于连续向量空间,只在最后翻译成词。它用一个网络实现去噪和解码,引入自条件机制。实验显示,ELF用不到其他方法十分之一数据,生成质量全面领先。
香蕉和GPT Image之外的第3条路:华人15人团队造出AI生图黑马
一支不到15人的华人团队推出AI生图模型Uni-1.1,在Arena.ai榜单冲进全球前三。它将推理和生成融入同一模型,创意可控,价格低,已获阿迪等企业认可,未来将拓展到多模态系统。
腾讯组织大调整,前 OpenAI 研究员姚顺雨担任首席 AI 科学家
腾讯进行组织架构大调整,成立AI Infra部等部门。前OpenAI研究员姚顺雨出任首席AI科学家,兼任多职。此次调整旨在整合模型、数据、算力,腾讯还大力招募人才,此前元宝借开源起量,凸显自研重要性。
大模型幻觉检测新方法:实时高亮不确定内容
来自苏黎世联邦理工学院等机构团队,开发流式幻觉检测器,能在生成过程中即时标记幻觉实体。核心是识别具体“实体”是否虚构,实验表现出色,团队已将数据集和代码开源,有局限但应用前景好。
训练大模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家
动视暴雪、斯坦福大学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏大模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。
当SFT遇上RL:基于样本学习阶段的动态策略优化机制
在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。
Qwen-Scope:看穿大模型的“小心思”
Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的可解释性模块,通过在隐藏层插入SAE提取可解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,可前往Huggingface或魔搭体验。
企业养虾🦞(OpenClaw),虾住在哪里比虾本身重要
文章从企业 Agent 落地角度,探讨让龙虾发挥价值的方法。指出企业养虾和个人不同,需建知识体系,包括数据、关系、操作和技能四层。还以飞书为例,说明其优势,并强调知识体系才是企业真正资产。
创始人自曝让儿子辍学用AI上课、水平超同龄人!俞敏洪最先押注的“AI学校”,负债9亿不垮、现在要开到美国了
松鼠Ai创始人栗浩洋让儿子辍学用AI上课,称其水平超同龄人。该公司获俞敏洪投资,曾负债9亿,后转型靠学习机业务发展。现计划将“AI学校”开到美国,适配当地市场并回应数据安全顾虑。