视频匿名化」共找到 1735 篇相关文章

产品应用7

Gemini CLI 重磅更新:现已支持音视频处理,并带来多项体验升级

Gemini CLI 迎来重磅更新,带来多项改进。新增音视频输入(暂未正式开启)、增强 Markdown 功能,集成 VSCodium 和 Neovim,技术栈升级至 Ink 6 和 React 19,还有主题更新、隐私管理等优

AI寒武纪
新闻资讯7

Anthropic封杀48小时,逼出OpenClaw最强反击!龙虾首次会生视频

Anthropic封杀OpenClaw免费接口,OpenClaw推出2026.4.5王炸更新,支持视频生成和‘睡眠记忆’系统,还优提示词缓存。虽与Anthropic有波折,也反映开源项目依赖大厂模型的困境。

新智元
算法论文8

上交大54页综述讲透Agent认知外部的演进之路

上海交大联合多机构提交综述论文,首次以「外部」为统一视角,梳理了LLM Agent的记忆、技能、协议与Harness工程四大支柱。指出Agent实际进展取决于外部认知基础设施,而非模型能力提升。

机器之心
产品应用8

AI视频界变天!Decart发布实时“Sora”,直播/游戏业或遭降维打击

Decart创业公司推出全球首个实时、无限长度的AI视频模型MirageLSD,基于独创LSD技术。其响应低于40毫秒,靠历史增强等技术攻克难题。它不止用于特效,平台将持续升级,创始人目标是打造‘千亿级独角兽’。

AI工程化
开源动态8

多模态开发革命!Gabber开源:图形构建实时AI应用,效率提升10倍!

AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块与图形开发,有诸多特性,还给出安装指南,适用于多种场景。

开源星探
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。

新智元
开源动态8

刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。

新智元
算法论文8

攻克长文档与多模态挑战,Paper2Video实现学术视频的自动生产

新加坡国立大学 Show Lab 团队主导研究,提出 Paper2Video 基准及评价指标,还推出 PaperTalker 多智体框架实现学术视频自动生产,实验显示其在多方面表现佳,效果接近人工水平。

机器之心
推荐文章8

转载 | 鄂维南院士:关于推动AI从工程走向科学的一点思考

鄂维南院士探讨推动AI从工程走向科学。回顾AI先驱,指出基础理论滞后致发展起伏、大模型开发依赖经验。介绍AI主要方法,分析深度学习基础理论问题,强调从系统角度看待AI,认为已到科学转折点。

力学与人工智能
开源动态8

港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽

香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。

量子位