音视频智能」共找到 4264 篇相关文章

推荐文章8

国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路

北大卢宗青是国内第一视角数据最早押注者和隐空间路线推进者。他认为人类视频是具身智能唯一可规模化的数据路径,创立BeingBeyond走隐空间世界动作模型路线,成本低、推理快,还发布全球首个隐式触觉世界动作模型Being - H0.8。

AI科技评论
产品应用7

又多了一个哄孩子AI神器,一张破涂鸦竟能秒变迪士尼动画

年轻父母有了哄娃新法子,用AI可将涂鸦变动画。博主用Midjourney将妈妈30年前涂鸦做成动画,还给出提示词框架。介绍即梦、可灵、谷歌Veo3等工具,它们能快速生成视频,各有优劣。还提到Meta的Animated Drawings玩法。

机器之心
推荐文章8

Karpathy:LLM渴望的不是生存,而是你的点赞

Andrej Karpathy指出人们对‘智能’理解肤浅,动物智能与LLM智能源于不同优化压力。动物智能源于自然选择,而LLM智能来自统计模拟、强化学习微调等,两者在多层面有差异,LLM受商业进化影响大。

AI寒武纪
开源动态8

科学智能2.0的「最强大脑」!上智院复旦无限光年联合发布开放平台

WAIC 2025上,上海科学智能研究院、复旦大学、无限光年联合发布「星河启智科学智能开放平台」。它以六大核心能力打造科学智能生态、驱动科研范式变革,致力于实现「科学的AI次方」效应。

新智元
8

先用为快——企业微信 AI 新版深度剧透

本文深度剧透企业微信 AI 新版,其升级对 AI 办公解读和实践领先,场景把握佳。新增智能搜索、智能总结、智能机器人等套件,还有智能表格、邮件等特性,还升级海外版与私有部署版本。

MacTalk
算法论文8

ICRA 2026|NUS邵林团队提出T(R,O) Grasp:刷新跨智能体灵巧抓取SOTA,实现5FPS动态环境交互

新加坡国立大学邵林团队提出T (R,O) Grasp,这是基于物体—机器手空间关系建模的图扩散架构,有跨智能体统一表征能力,在多种智能体上平均抓取成功率达94.83%,刷新跨智能体灵巧抓取SOTA。

机器之心
推荐文章8

关于 Multi-Agent 到底该不该做,Claude 和 Devin 吵起来了

有两篇多智能体文章引发热议。Anthropic分享多智能体研究系统构建经验,指出适合特定任务;Cognition认为当下AI Coding暂不适用多智能体。文章还介绍多智能体架构、提示词原则等内容。

Founder Park
新闻资讯8

ImageNet作者苏昊回国任教复旦!李飞飞高徒,具身第一高引,出任通用物理AI院长

具身智能领域论文被引次数最高的华人学者苏昊回国加盟复旦,将担任浩清特聘教授,领衔建设通用物理智能研究院并出任院长。苏昊成果丰硕,他认为复旦要做的事与自己一致,对具身智能持“谨慎的乐观”态度。

量子位
新闻资讯7

蚂蚁投了一家上海具身智能公司

马年新春,蚂蚁集团领投上海具身智能创业公司大晓机器人,这是蚂蚁2026年首笔具身智能投资。大晓机器人刚完成天使轮融资,资金用于技术迭代与产品落地,其核心团队实力强劲。

量子位
产品应用7

SkyReels-Audio让嘴型和频完美匹配不再难

频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。

带你学AI