AI短视频」共找到 10240 篇相关文章

开源动态7

OVI:统一的音视频生成模型,声音与画面同步诞生

视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。

带你学AI
开源动态8

机器人看29s视频学会一个新技能,自变量开源HOST框架

自变量机器人开源的HOST框架,让机器人看29s人类示范视频就能学会新技能,原技能不受影响。它通过自定位级联预测,解决了人和机器人动作节奏、身体结构不同的问题,效率远超主流微调方案,推动机器人进家庭。

PaperAgent
新闻资讯7

今年最火的AI产品,不止龙虾|榜单申报中

量子位开展2026年度值得关注的AIGC企业和产品评选,参选有对应条件和评选维度。报名4月27日截止,结果5月中国AIGC产业峰会公布。峰会将聚焦‘如何用好AI’。

量子位
产品应用7

低延时、可交互的音频驱动肖像视频生成框架LLIA

美团提出新型音频驱动肖像视频生成框架LLIA,是低延迟、可实时交互的虚拟形象生成技术。它提出四项核心技术,引入三大核心模块,构建超100小时数据集,在多方面有出色表现。

带你学AI
新闻资讯8

千丁数科魏振华:企业AI落地“六步法”|甲子引力

2025年12月3日,千丁数科COO兼首席科学家魏振华在甲子引力年终盛典上,结合龙湖数字化沉淀与实践,复盘企业AI落地。他提出“六步法”,并展示六大场景数据,为传统行业智能化转型提供参考。

甲子光年
新闻资讯8

来自MIT最强AI实验室:OpenAI天才华人研究员博士毕业了!

OpenAI华人研究科学家陈博远完成MIT博士论文答辩。他不到4年读完博士,辅修哲学,是GPT图像生成核心成员和Sora视频团队成员,将推进世界模型技术,强调视觉世界模型对具身智能至关重要。

新智元
新闻资讯7

基金委鼓励AI与力学各个方向的交叉和融合

基金委鼓励AI与力学各方向交叉融合。力学含多分支学科,在各领域研究中,既支持基础前沿研究,推动与新兴领域交叉,又重视与重大需求融合,还鼓励利用现有条件研发软件和仪器。

力学与人工智能
算法论文8

一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线

Anthropic和牛津大学研究发现,大模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。

AIGC开放社区
产品应用8

AI不再「炫技」,淘宝要让技术解决用户每一个具体问题

技术发展迅速,淘宝力求将AI融入应用场景解决用户问题。今年3月升级AIGX技术体系,近日郑波公开淘宝全模态大模型进展,认为狭义AGI或5 - 10年到来,多模态智能成关键技术域。

机器之心
新闻资讯7

315曝光的“AI投毒”原理:GEO这样操控大模型推荐

央视3·15晚会揭开AI“投毒”灰色产业链,利用GEO操控大模型推荐。介绍了训练数据污染、检索上下文劫持、提示注入诱导攻击三种“投毒”技术,还阐述了内容生产、渠道投放、效果强化的产业链运转流程。

量子位