「AI视频创作」共找到 10191 篇相关文章
搜狐架构演进技术实践:我们如何用 MCP Registry 根治 AI Agent 的“千具之灾”
本文讲述搜狐团队在构建企业级 AI Agent 时遭遇‘千具之灾’,当前路由模型方案引发‘治理噩梦’。后通过研究 MCP Registry 获新思路,设计新架构,构建 PoC 原型,并对混合路由等问题展开思考。
支付宝 AI 出行助手高效研发指南:4 人团队的架构迁移与提效实战
本文介绍支付宝AI出行助手研发历程,其集成多种出行功能,基于xUI + KMP框架搭建。分享研发实践、挑战与策略,如迁移基础能力、卡片生态,适配标准框架,还提及KMP应用及数据度量体系,取得业务和研发效能成果。
通勤路上修故障?钉钉机器人+ OOS AI 助手实现 7×24 小时运维自由
传统运维依赖电脑,突发故障时受限。阿里云OOS AI助手结合钉钉机器人,实现免登录、跨设备、秒级响应的运维操作。如运维工程师张伟深夜在家用此组合10分钟解决故障,还介绍了使用和配置方法。
用DAA衡量智能体 百度智能云用“新全栈”重新定义AI云|甲子光年
2026年产业焦点转向智能体落地,李彦宏提出DAA概念。百度智能云升级为新全栈AI云,解决智能体落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。
AI「偷学」你的数据?6大顶级机构联手提出数据保护4大分级体系
生成式AI普及,数据保护成挑战。来自多机构研究者发布论文,提出全新数据保护分级体系,分为数据不可用、隐私保护、可溯源、可删除四级,还探讨了技术、法规及面临的挑战。
图像编辑缺训练数据?直接从视频中取材,仅用1%训练数据实现近SOTA效果
百度研究人员提出将图像编辑视为退化的时间过程,Video4Edit利用视频预训练模型知识迁移,仅用主流编辑模型约1%监督数据,在图像编辑任务达近SOTA效果,解决数据稀缺与权衡难题。
AI发现医生看不见的隐藏心脏病风险,近90%准确率远超人类专家|Nature子刊
登上《Nature》子刊的研究显示,约翰霍普金斯大学团队开发的多模态AI模型MAARS,用深度学习处理原始MRI图像,实现对心源性猝死风险高精度预测,准确率达89%,还能辅助制定个性化医疗方案。
AI无限生成《我的世界》,玩家动动键盘鼠标自主控制!国产交互式世界模型来了
昆仑万维带来交互式世界模型Matrix - Game,可让用户用键鼠探索创作虚拟内容。它发布了Matrix - Game - MC数据集、主模型和GameWorld Score评测体系,在多项评测中领先,还能在多领域发挥作用。
不再止步于自然语言!PhiZero让世界模型学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。
AAAI 2026|视频大语言模型到底可不可信?23款主流模型全面测评来了
合肥工业大学与清华大学团队推出视频大语言模型综合可信度评测基准 Trust-videoLLMs,对 23 款模型从五维度 30 项任务评测,揭示性能格局,指出模型现存问题,还开源评测框架等。