视频问答」共找到 1075 篇相关文章

产品应用7

机器人WAIC现场抢活讲PPT?商汤悟能具身智能平台让机器人「觉醒」

具身智能火爆但面临数据瓶颈等难题。商汤在WAIC推出具身智能平台「悟能」,以世界模型为引擎,有感知、导航、交互等功能,其开悟世界模型能生成多视角视频,为机器人提供数据支持。

新智元
产品应用8

Sora 2刷屏全网:拍《瑞克和莫蒂》、过物理测试,太棒了

OpenAI推出的Sora 2刷屏海外,能完成以往视频生成模型极难实现的任务,在物理准确性、逼真度和可控性上有重大提升。它还能进行二创、模拟电脑操作等。OpenAI发布由Sora 2驱动的社交APP,强调促进创作,保障安全。

AI进修生
开源动态8

看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了

Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。

PaperAgent
产品应用7

Seedance 2.0现象级刷屏!深度测评:复杂场景贼稳,连asmr都会?

字节上线的Seedance 2.0全网刷屏,马斯克怒赞,外国网友催更。它在多模态输入上升级,画面一致性更稳可控,还有一镜到底、完整剧情输出功能,视频长度和音效也能DIY,虽有小bug,但日常创作够用。

量子位
开源动态8

蚂蚁开源世界模型LingBot-World:具有分钟级记忆的实时世界模拟器

蚂蚁集团旗下灵波科技开源具身智能模型及世界模型LingBot-World,它将视频生成模型进化成可交互世界模拟器,采用多阶段进化策略,有涌现记忆等能力,虽有不足,但为开源社区构建世界模型迈出坚实一步。

AIGC开放社区
新闻资讯8

硅谷今日最热具身模型!不用后训练,看一遍就学会

北美具身初创Skild AI发布全新机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。

量子位
新闻资讯7

「回答一切」吐槽潮中 Sam Altman 确认: 4o 回归,GPT-5 将进行六大改进

OpenAI在Reddit举行GPT - 5问答活动,网友吐槽多。Sam Altman确认GPT - 4o回归,还表示GPT - 5将进行加倍调用速率、保留旧模型选择权等六大改进,同时回应了用户对旧模型、调用限额等方面的质疑。

AI寒武纪
新闻资讯8

Gemini 3.5来了!今夜,谷歌亲手淘汰谷歌

谷歌I/O 2026大会火力全开,发布Gemini Omni、3.5 Flash、Spark等新品。Omni可接收任意输入生成视频,3.5 Flash性能强大,Spark是7×24h云端个人AI特工。谷歌多项能力同时到位,撕开了ASI入口。

新智元
新闻资讯7

小扎AI眼镜当场死机,CTO自曝灾难级演示内幕:一个指令干趴自家服务器

小扎演示Meta智能眼镜Ray - Ban Display时翻车,AI助手回应异常、视频通话失败。CTO复盘,一是指令致多眼镜激活干趴服务器,二是时机糟的Bug。虽演示失败,但Meta仍豪掷千亿布局AI。

新智元
产品应用8

拳打可灵,脚踢 Veo 3,谁是物理世界的「懂王」?

多模态视频生成大模型是复杂系统工程,多为巨头游戏。MiniMax的Hailuo 02发布,ELO得分超谷歌Veo 3和快手Kling 2.0。它能呈现复杂运动,处理物理关系,提升训练推理效率,成本低,后续还将更新。

AI科技评论