视频预测」共找到 1378 篇相关文章

新闻资讯8

Jeff Dean最新访谈:未来开发者人均50个智能体,写需求成核心技能

谷歌首席AI科学家Jeff Dean在访谈中预言,未来开发者人均管理50个智能体,写需求成核心技能。他还揭秘谷歌帕累托前沿策略,介绍蒸馏技术让小模型接近大模型性能,强调多模态及低延迟价值,给出未来模型发展预测

量子位
算法论文8

ICLR 2026 Oral | 西湖大学发布Real PDE Bench

复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。

力学与人工智能
推荐文章7

LightX2V Ulysses Attention 实现学习笔记

本文记录了LightX2V中Ulysses Attention的实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。

GiantPandaLLM
新闻资讯8

Anthropic刚发布了一份「AI抢饭碗报告」:学历越高越「被抢」

Anthropic《经济指数报告》揭示,任务越复杂AI加速越猛,学历高的工作受影响大。还指出人机协作能大幅提升任务时长,不同国家AI应用有贫富和技术代差,也提到了‘去技能化’问题及对生产率的预测

新智元
推荐文章7

“不是...而是...”刷屏的一年,我读内容的快乐被AI偷走了。

作者补完《怪奇物语》后看B站解说视频,因文案中“不是...而是...”句式不适,由此探讨人们讨厌AI生成内容的原因,指出其像新时代八股文,还提及全球对AI内容的不信任,呼吁保持与他人的真实连接。

数字生命卡兹克
新闻资讯8

LeCun亲自出镜打脸质疑者!憋了20年的AI世界模型,终于爆发了

LeCun亲自出镜介绍V-JEPA 2新进展,目标是开发改变AI与物理世界交互的世界模型。V-JEPA 2基于视频训练,有两阶段训练细节,能用于机器人规划,Meta还发布三个基准测试,后续将研究分层和多模态JEPA模型。

新智元
新闻资讯7

数据中心热潮没有消退,但巨头们确实按了“暂停键”

市场对数据中心热潮是否结束感到焦虑,但AI整体资本支出强劲,市场需求是“暂时的暂停”。麦肯锡预测未来五到七年数据中心市场将保持20%至25%的增长范围。科技巨头重申市场强劲,同时数据中心扩张面临能源瓶颈等挑战。

芯师爷
新闻资讯7

10 天 3000 元,一人造出全球 AI 爆款!好莱坞导演抢人、游戏版引爆期待,合作细节首次披露

中国 29 岁中专毕业的 AI 视频创作者 Mx - Shell 用 10 天、3000 元成本做出 AI 短片《丧尸清道夫》爆火,海外 CEO 隔空递 offer。短片将推大银幕版,游戏版也在制作。Yoroll 创始人谈 AI 互动游戏赛道玩法、商业化等问题。

AI前线
开源动态8

腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实

腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。

AIGC开放社区
产品应用8

Nano-Banana 核心团队分享:文字渲染能力才是图像模型的关键指标

谷歌新发布的图像生成与编辑模型Gemini 2.5 Flash Image(Nano - Banana)热度超Grok视频生成。文章通过团队访谈,介绍其图像创作新方式、文字渲染代理指标、交错生成能力等,还对比了与Imagen差异,展望AI终极形态。

Founder Park