视频数据集」共找到 3397 篇相关文章

开源动态8

哔哩哔哩献给二次元世界的礼物—AniSora,目前最强大的开源动漫视频生成模型

动画视频生成评估挑战大,现有模型处理动画视频力不从心。哔哩哔哩推出AniSora综合系统,支持一键生成多种动漫风格视频镜头,在角色和动作表现上出色,在多维度超越当前先进模型。

带你学AI
开源动态8

达摩院推出多智能体框架ReasonMed,打造医学推理数据生成新范式

在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级高质量数据ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。

机器之心
新闻资讯7

别只盯着李飞飞!AI的「3D数据底座」已被这家中国公司悄悄建好

群核科技构建具身智能时代的「3D版ImageNet」,其SpatialVerse平台为机器人提供三维数据与仿真环境。借助新技术发布全球首个3D语义数据InteriorGS,还与多机构合作,成果获学术和产业认可。

新智元
算法论文8

不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果

上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。

机器之心
算法论文8

合成数据≠生成模型:一文读懂合成数据的全新范式

最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
新闻资讯8

数据限制具身?觅蜂杀进场破局:高质量数据水电一样即取即用

2026年4月16日,觅蜂科技发布一站式物理AI数据服务平台等,董事长姚卯青称当前具身智能面临数据荒漠问题。觅蜂打造“又全又好又快”数据供给,还启动蜂巢数据共创行动,与多家企业合作。

机器之心
算法论文8

TACL 综述 | 别只卷架构了——长文本模型的能力天花板,其实是数据决定的

该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力的数据配方与评估法,还整理数据和基准,提出待解问题。

深度学习自然语言处理
算法论文8

1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿

上海AI Lab主导,25家研究机构共同梳理270+训练、190+评测,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。

PaperAgent
算法论文8

上交、清华、微软、上海AI Lab等联合发布数据分析智能体综述,LLM化身数据分析师,让数据自己「说话」

传统数据分析方法耦合度高、扩展性差,大语言模型与智能体让数据分析迈向“语义理解”。上交、清华等机构联合撰写综述,回顾演进,提出新范式,总结关键技术、趋势及挑战,推动通用数据分析智能体发展。

机器之心
产品应用8

超越Runway!Adobe发布新神器:P视频比P图还简单

Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。

新智元