「视频智能体」共找到 4284 篇相关文章
8K Star!给所有 AI 编程工具加个智能调度中心,节省 20-40% Token!
AI编程圈火了个工具9Router,它是智能调度中心,能连接主流编程工具,自动路由到40多家AI提供商和100多个模型,自带RTK Token节省器,还有实用的三级降级机制,安装配置简单。
营收破亿,光轮智能完成数亿元 A 及 A+轮融资,揭秘机器人「数据荒」背后的生意经
近日,光轮智能完成数亿元 A 及 A+轮融资,已与全球头部企业合作,年营收破亿。其创始人谢晨博士指出机器人基础模型开发存在数据短缺问题,光轮通过仿真环境生成数据,是 NVIDIA 生态核心伙伴。
用“因果规划”解决多智能体协作中的任务依赖难题|港科广&腾讯
港科广和腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界多智能体系统。该方法含全局因果任务图,框架分“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。
Agent引爆产品新思维、奇点智能研究院正式成立!2025 全球产品经理大会首日精彩速览
8月15日,2025全球产品经理大会开幕,众多专家分享见解。奇点智能研究院成立,聚焦AI多范式转换设六大研究领域。李建忠、方汉等嘉宾探讨AI产业生态、产品创新等,还涉及GenAI交互设计、AI产品“人味”等内容。
AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源
快手全新多模态大语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。
实测Gemini图片转视频新功能,终于蹲到经典梗图后续了(doge)
Gemini接入带声音的图片转视频功能,作者实测该功能。用开盒指令测试,生成速度较快;还尝试给梗图加后续,发现生成精确内容需详细提示词,且不能生成具体真人形象内容。
无需训练,即插即用,2倍GPU端到端推理加速——视频扩散模型加速方法DraftAttention
高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成推理瓶颈。现有加速法效果不佳,为此美国东北大学等团队提出DraftAttention,可2倍加速推理且不损画质。
独家:逐际动力前COO张力加入具身智能大脑初创企业BeingBeyond|甲子光年
「甲子光年」独家获悉,逐际动力前COO张力今年四月初加入具身智能大脑初创企业BeingBeyond。该公司聚焦模型算法,其Being - H系列模型成果突出。张力加入或使公司向可规模化运转转变。
ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态
滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。
信息量爆炸!OpenAI内部路线图首次全曝光,首席科学家亲口承认:超级智能10年内到来
OpenAI宣布重组完成后,Sam Altman和首席科学家Jakub Pachocki直播公开内部路线图,称深度学习或10年内实现超级智能,还公布了AI研究目标与时间线,涉及产品、基建等多方面规划。