短视频」共找到 1220 篇相关文章

算法论文8

离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式

杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。

量子位
新闻资讯7

估值7亿美元!OpenAI前高管杀进工厂,要给流水线装上AI大脑

2024年硅谷经历OpenAI高管离职潮,前首席研究官Bob McGrew联合创办Arda,将AI带入制造业工厂。Arda以7亿美元估值融资7000万,开发视频模型让机器人自主学习,统筹生产线的人与机器。不过,制造业引入AI面临挑战。

新智元
新闻资讯8

三天逆袭,Sora登顶美榜!15秒大片玩疯奥特曼,全网直呼真假难辨

上线三天,Sora APP登顶美国App Store榜首,Sora 2的「客串」功能和物理智能实现音画同步,奥特曼亲自下场被玩坏。Sora 2 Pro一次可拍15秒大片。奥特曼预告两大更新,Sora却带来视频造假隐患。

新智元
产品应用8

AI搜索MCP服务来了,Agent直接链接实时信息!刚刚,百度智能云打出了张“王牌”

‘Agent元年’进程过半,Agent卡在‘信息断层’瓶颈。百度智能云千帆平台开放百度AI搜索能力,补上Agent实时信息板。同步登场的千帆4.0多维升级,聚合150+精选模型服务,构建企业级Agent有四大关键要素。

量子位
开源动态8

jina-embeddings-v5-omni 发布!全模态向量小模型

Jina AI发布`jina-embeddings-v5-omni`,将`v5-text`能力拓展到多模态。`v5-omni-small`参数量小却追平LCO - 7B,在多模态评测中表现优异,但视频板。其采用‘冻结 + 投影’架构,训练快、省显存。

Jina AI
算法论文7

Qwen负责人转发2025宝藏论文,年底重读「视觉领域GPT时刻」

2025年末,Qwen大模型技术负责人林俊旸转发谷歌DeepMind入选ICCV 2025的论文,指出视觉领域“GPT时刻”要来了。研究用实验数据证明,视频模型正跳出任务专属局限,实现一个模型完成多视觉任务,推理过程还能被CoF“演”出来。

量子位
推荐文章8

国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路

北大卢宗青是国内第一视角数据最早押注者和隐空间路线推进者。他认为人类视频是具身智能唯一可规模化的数据路径,创立BeingBeyond走隐空间世界动作模型路线,成本低、推理快,还发布全球首个隐式触觉世界动作模型Being - H0.8。

AI科技评论
8

全网最强万字解读:DeepSeek-V4 掀翻了谁的桌子? | GAIR live 030

文章深度解读了DeepSeek-V4,从产业、生态和架构维度拆解其效率账本。它成本低,补齐板适配昇腾芯片,但极致省钱也有代价,如性能衰减、架构复杂等。还探讨了长上下文、MoE与稠密模型路线差异及商业化潜力。

AI科技评论
新闻资讯8

机器人“真干活”,为什么宁德时代选择了银河通用?|甲子光年

宁德时代与银河通用签署全球战略合作协议,推动具身智能机器人在全球市场拓展及规模化应用。银河通用重载机器人Galbot S1已在宁德时代产线作业,其核心技术“银河星脑”能让机器人适应复杂环境。双方还在服务体系上合作,补齐规模化部署板。

甲子光年
新闻资讯7

今晚直播|从《黑客帝国》到迪士尼乐园:谈《拟像与拟真》

法国后现代思想大师让·波德里亚在《拟像与拟真》中预警数字时代图景。2025年12月5日19:30 - 21:30,豆瓣读书等邀多位学者结合电影探讨波德里亚思想及拟像概念,直播将在豆瓣读书视频号同步。

豆瓣读书