图像和视频换脸」共找到 7608 篇相关文章

推荐文章7

中年人的认知坍塌

Andrej Karpathy在播客提到模型持续用合成数据训练会出现‘认知坍塌’,能力退化。他认为人类随年龄增长经验固化,也会从无限可能收敛到固定思维模式,像极了中年人的认知坍塌。

newtype AI
算法论文8

NTU等联合提出A-MemGuard:为AI记忆上锁,投毒攻击成功率暴降95%

在AI智能体依赖记忆系统的当下,记忆投毒攻击兴起。A-MemGuard作为首个为LLM Agent记忆模块设计的防御框架,通过共识验证双重记忆结构,解决防御难题,使投毒攻击成功率暴降超95%。

新智元
推荐文章8

阿里云CIO首次系统复盘:大模型落地的 RIDE 方法论与 RaaS 实践突破

阿里云智能集团 CIO 蒋林泉分享大模型落地实践,指出企业中业务与 IT 对 AI 认知矛盾突出。他展示阿里云数字人落地成果,提出 RIDE 方法论,还剖析翻译 Agent 两种应用模式及落地要点。

AI前线
开源动态8

首个基于MCP 的 RAG 框架:UltraRAG 2.0用几十行代码实现高性能RAG, 拒绝冗长工程实现

检索增强生成系统(RAG)复杂度提升,工程实现成本高。清华大学等联合推出首个基于MCP架构的UltraRAG 2.0,组件化封装、调用扩展灵活,低代码实现高性能,可用于科研行业应用。

AI前线
开源动态7

The Batch: 862 | OpenAI 的重新"开放"

OpenAI 发布自 2019 年 GPT - 2 以来首个开源权重模型 gpt - oss 系列,含 gpt - oss - 120b gpt - oss - 20b,为智能体应用设计,免费使用修改。介绍其输入输出、架构等,还对比了性能表现。

DeeplearningAI
新闻资讯7

GPT-5 之后,我们离 AGI 更近了,还是更远了?

2025年8月8日OpenAI发布GPT-5,架构有革新,在基准测试成绩优异,但跑分现场PPT出错、被Grok 4击败。它在编程表现出色、价格有竞争力,写作能力有争议,模型幻觉提示注入攻击问题待解。

AI科技大本营
算法论文8

微软再放LLM量化大招!原生4bit量化,成本暴减,性能几乎0损失

微软公布BitNet v2,性能几乎0损失,占用内存计算成本显著降低。它首次实现对1比特LLMs的原生4比特激活值量化,通过H - BitLinear模块处理异常通道,实验显示其在多方面表现优异。

新智元
新闻资讯7

比996更高效!夫妻合伙人不「下班」,狂赚$4700万

AI初创公司Serval的CEO Jake StauchCOO Tatiana Birgisson这对夫妻创业成功获4700万美元融资。他们将工作与生活高度融合,工作高效且家庭温情,证明工作与生活深度整合模式的价值。

新智元
开源动态8

小红书提出DeepEyesV2,从“看图思考”到“工具协同”,探索多模态智能新维度

小红书推出多模态模型DeepEyesV2,它延续视觉推理优势,实现代码执行、网页搜索图像操作的全工具协同。通过多工具协同推理解决复杂问题,采用两阶段训练策略,准确率远超开源模型。

量子位
开源动态8

清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源

清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。

机器之心