「视频Agent」共找到 3552 篇相关文章
硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了
旧金山AI技术大会上,企业大佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。
一个开源平台,编织起了Agent「互联网」
如今 Agent 单体能力强但系统分散,开源平台 Octo 应运而生。它由明略科技打造,可聚合 Bot,让其成为企业级资产。Octo 重写协作,有 Matter 沉淀任务,塑造 Taste 让 Agent 更懂用户,还有六种协作模式。
多人会话视频生成新突破:香港科技大学,浙江大学用单人数据实现多人交互视频生成
香港科技大学、浙江大学等开源 AnyTalker,提出音频驱动多人交互生成新范式。它用创新机制和两阶段训练策略,以少量数据实现多人视频生成,还构建评估指标,性能超现有方法。
阿里AgentBay揭秘,Agent Infra才是真护城河!
在云栖大会上,阿里云无影宣布Agent基础设施AgentBay重大升级,展示全新个人计算产品。它有完善能力,可调用云上资源。文章还阐述了Agent Infra的必要性、进化体现及成本优势,指出优化环境很重要。
每秒生成超30帧视频,支持实时交互!自回归视频生成新框架刷新生成效率
微软研究院与北大联合发布Next - Frame Diffusion (NFD)新框架,通过帧内并行采样、帧间自回归等方式,让视频生成在保持高质量的同时,效率大幅提升,还采用多项技术进一步优化。
让Agents更聪明,3招搞定记忆管理~
文章深度分析开源项目Memori,探讨Agent记忆管理。它将记忆分短期和长期,通过三个Agent协同工作实现长短期记忆功能,使记忆成结构化知识库,且能无缝衔接多种API。
吴恩达:并行 Agent是 Scaling laws 的新方向
吴恩达称并行 Agent 是扩展 AI 新方向。过去 AI 靠数据和计算量提升能力,如今并行 Agent 能在不增加用户等待时间前提下提升效果,虽任务分解有难点,但研究不断涌现。
Agent上下文工程被Cursor玩出了新高度~
Cursor的agent为所有模型使用动态上下文,在保持质量时更智能填充上下文。代码Agent改变软件开发方式,Cursor提出动态上下文发现模式,介绍了在其中使用该模式的做法及优势。
windsurf分享了他们对构建Agent应用的认知。
windsurf发表博客讨论Agent,指出构建Agent应用存在认知误区,分享灵魂四问分析框架评估其‘含金量’,还提到苦涩教训,提醒警惕过度设计,拥抱规模化、通用化方法。
SIGCOMM 2026 | 从「人眼看视频」到「AI理解视频」:北大提出面向AI的实时通信框架Artic
AI 正从「文字聊天」走向「边看边聊」,传统实时视频通信难以满足需求。北大团队提出 Artic 框架,重构码率自适应等,实验显示其能显著提升准确率、降低延迟。