图像和视频换脸」共找到 7610 篇相关文章

推荐文章7

对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds

本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆多为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。

海外独角兽
开源动态8

阿里开源创新AI Agent:媲美Deep Research,Github每日增长第一

人类信息检索能力受限,OpenAI的Deep Research虽能解决难题但闭源。阿里巴巴通义实验室开源AI Agent框架WebSailor,在多基准测试表现出色,核心技术围绕复杂任务生成强化学习模块展开,在Github成绩亮眼。

AIGC开放社区
算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式

上海人工智能实验室提出策略判别学习(POLAR)新范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能泛化性优越。

量子位
新闻资讯8

谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?

北京时间5月21日凌晨,谷歌在I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型更好的2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3等,编码助手Jules公测。

InfoQ
产品应用8

国产GPU开始造世界!国内首个全栈具身智能仿真平台来了

摩尔线程发布国内首个全栈国产化具身智能仿真平台MT Lambda,实现Sim-to-Real真机验证。该平台像物理AI训练流水线,集成物理、渲染、AI引擎。其依托全功能GPUMUSA架构,还构建了云端、端侧、生态闭环。

量子位
算法论文8

ICLR 2026|首个微观世界模型MicroVerse来了,AI开始模拟看不见的世界

过去两年,世界模型成为大模型演进重要方向,但现有模型多聚焦宏观世界。本文提出MicroVerse模拟框架,将研究边界拓展到微观尺度,还推出MicroWorldBench评测基准MicroSim - 10K数据集,推动AI从视觉模拟迈向科学模拟。

机器之心
新闻资讯7

马斯克冲刺机器人量产,果断停产特斯拉豪华车型!2026年资本支出将“非常大”

在最新财报电话会议上,马斯克宣布特斯拉2026年第二季度停产豪华车型Model SModel X,为擎天柱机器人让出生产线,还将投资20亿美元给xAI,今年资本支出或超200亿美元。此外,Neuralink也有新进展。

量子位
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型数据集上性能提升显著。

深度学习自然语言处理
8

中科院信工所发布首篇LLM智能体幻觉综述!梳理5类幻觉、18大诱因与10种缓解方案,300+论文资源开源

中科院信工所等机构团队发布首篇聚焦LLM智能体幻觉的综述,厘清其与传统语言幻觉区别,提出5类幻觉分类体系18大触发原因,给出10种缓解策略,还开源300+论文库并指明未来研究方向。

深度学习自然语言处理
产品应用8

大模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent