数字人视频」共找到 2219 篇相关文章

算法论文8

攻克长文档与多模态挑战,Paper2Video实现学术视频的自动化生产

新加坡国立大学 Show Lab 团队主导研究,提出 Paper2Video 基准及评价指标,还推出 PaperTalker 多智体框架实现学术视频自动化生产,实验显示其在多方面表现佳,效果接近工水平。

机器之心
开源动态8

港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽

香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。

量子位
产品应用8

比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一

昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。

机器之心
新闻资讯7

阿里批准林俊旸离职,CTO周靖接管千问!Gemini周浩确定加盟

阿里巴巴CEO吴泳铭批准林俊旸辞职,周靖接管千问。此次事变动突然,引发诸多猜测。阿里高层称是为扩充团队、投入资源。Gemini 3.0核心贡献者周浩据传将主导千问后训练。

量子位
推荐文章7

不是视频模型“学习”慢,而是LLM走捷径|18万引大牛Sergey Levine

UC伯克利大学副教授Sergey Levine提出,为何语言模型从预测下一词中学到很多,视频模型从预测下一帧却学得少。他指出LLM可“抄近路”模仿类推理,像在“柏拉图洞穴”中,还探讨了AI走出困境的方法。

量子位
产品应用7

革了程序员再革打工:Anthropic发布Cowork,Claude Code走进数字办公自动化

Anthropic发布Cowork,让Claude Code走进数字办公自动化。Cowork是Claude Code理念延伸,能让普通用户驾驭强大代理能力,还能跨应用协作。不过使用时要警惕赋予权限、提示注入等风险。

AIGC开放社区
算法论文8

732M模型超越7B!机器操控新范式:从视频中「悟」物理

机器操控有「数据困境」,传统方法需大量工标注动作演示数据。中山大学王广润教授团队从视频生成模型「借」物理直觉,提出PAR和PhysGen,与英伟达DreamDojo核心思路一致,验证了新的技术路线。

新智元
新闻资讯8

刚刚,小扎成立「超级智能实验室」!11豪华阵容曝光,华占多半

小扎官宣Meta「超级智能实验室」(MSL)成立,合并内部三大AI团队,28岁Alexandr Wang任首席AI官,公布11豪华团队名单,团队多来自谷歌、OpenAI等大厂,目标开发超级智能。

新智元
新闻资讯7

烧光600亿,小扎再砍元宇宙1500!6000亿豪赌算力帝国

Meta计划裁减Reality Labs 10%员工,约1500,元宇宙相关岗位首当其冲。自2020年起,Meta在元宇宙投入超600亿美元却未形成稳定收入。同时,Meta推出绩效改革,顶尖员工最高拿300%奖金,还官宣千亿豪赌算力帝国。

新智元
算法论文8

小红书RecSys 2025最佳论文提名背后:破解视频时长预测难题

小红书推荐算法团队论文《Multi-Granularity Distribution Modeling for Video Watch Time Prediction via Exponential-Gaussian Mixture Network》在 RecSys 2025 获最佳论文提名。该文剖析视频时长预测难题,提出 EGMN 模型,线下线上验证效果佳。

机器之心