「视频Agent」共找到 3567 篇相关文章
Cursor:AI编程「第三时代」来了
近日,Cursor CEO Michael Truell 称 AI 编程迈入「第三时代」,特征是 Agent 能在少人工干预下完成大规模任务。Cursor 核心转变,内部超 1/3 代码提交由云端智能体创建,团队预计多数开发工作将由其完成。
99% 确定:OpenAI Dev Day 将发布可视化 AI 工作流工具,“AI Fabric”成为新的关键词
全网传 OpenAI 将在 Dev Day 发布类似 n8n、dify 的 Agent Builder,TestingCatalog 试用称其为‘最流畅的 Agent 构建画布’。它能让开发者在统一界面操作,或影响自动化工具市场。
英伟达让机器人「做梦学习」,靠梦境实现真·从0泛化
英伟达推出DreamGen项目,让机器人‘做梦学习’。它利用视频世界模型生成神经轨迹,仅少量现实视频就能让机器人学会新任务,实现从0泛化,还将助力GR00T - Dreams发展。
老黄爆改英伟达,Salesforce一次招千人!智能体时代应届生机会来了
Salesforce CEO Marc Benioff要招1000名应届生或实习生,IBM北美入门级岗位扩招3倍,麦肯锡等也在扩招。智能体时代新入门岗位诞生,应届生定义将被重写,会与agent协作的人是企业争抢对象。
英伟达震撼首测Vera Rubin,DeepSeek吞吐暴涨30倍!
英伟达公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。
震撼好莱坞,一天AI生成10部短片,Google神器比肩一个影视工作室
Google的AI视频神器Veo 3刷屏,使用门槛低,生成效率高,效果震撼。它能生成二次元、科幻、仙侠等多种类型短片,虽有不足,但极大促进AI视频发展,适合多行业基层人员。
Hermes 登顶 OpenRouter 之后,我才发现它最缺的那一块,被这个插件补上了
Hermes Agent 三个月登顶 OpenRouter,虽好用但记忆处理有缺陷,记忆库成大杂烩。记忆张量的 MemOS Local Plugin 2.0 可解决此问题,采用‘执行即学习’,有双层反馈机制,且资产可携带。
百度想明白了:旧供给到达极限了
当下企业应用AI时,Token成本高、推理效率低问题凸显。百度Create大会释放旧供给达极限信号,推出新全栈AI云,含Agent Infra和AI Infra两层架构,多个场景应用初显成效。
OpenClaw低调更新重磅版本,龙虾长手长脚了
OpenClaw开发者Peter带来Computer Use工具Peekaboo v3版本,解决了Agent类产品无法直接操控桌面的问题。它能实现像素级截图、读取UI位置,还能完成各类操作,支持自然语言指令,有四种使用方式。