「流匹配技术」共找到 3024 篇相关文章
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。
老黄怒怼玩家根本不懂AI!英伟达新AI功能遭全网抵制,游戏圈炸锅了
英伟达在GTC 2026发布DLSS 5,本应是“性能革命”,却遭游戏圈抵制。它用生成式AI“注入”光影和材质,从“帮放大画面”变为“帮重绘画面”,玩家不满AI网红脸,老黄称是“GPT时刻”。
让大模型“吃一堑长一智”,南理工百度等提出模型记忆新方法
南京理工大学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。
AI 时代,重新定义开发者丨最新白皮书解读
AI时代开发边界被重定义,更多非传统开发者用AI工具解决业务问题。知乎等发布白皮书,揭示新时代开发者画像、核心焦虑,还讲述其认知飞轮及案例,展现AI对开发的变革。
马斯克的作业还是被奥特曼「抄走了」
奥特曼宣布几周内发布ChatGPT新版本,12月推成人模式,让其重获个性化“灵魂”。这似在抄马斯克Grok作业,背后是为AI产品增长,当下AI之战已演变成争夺用户注意力和多巴胺的战争。
终结多智能体视觉幻觉“滚雪球”!新国立等提出ViF:无需改造模型,即插即用
多智能体协同做视觉任务常轮次越多错得越离谱,根源是信息传递方式有缺陷。新国立等研究人员提出轻量通用的ViF范式,无需改造基座模型,可大幅压制幻觉滚雪球,已入选ICLR 2026。
2025 年 InfoQ 趋势报告:云计算和 DevOps 篇
InfoQ 2025 年云计算和 DevOps 趋势报告展示技术采用阶段趋势图,介绍新增或更新技术。涉及 AI Agent、MCP、平台工程等趋势,指出云 DevOps 生态成熟有新挑战,新阶段需整合多种要素。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。
韩松贾扬清之后,又一家清华系AI公司卖给英伟达,黄仁勋亲自招募95后联创
继韩松、贾扬清后,又一家清华系AI公司Nexusflow被英伟达收购。黄仁勋招募其联合创始人,公司成果亮眼,如开源模型表现超GPT - 4等,这或与生态联系有关,收购也是英伟达活跃布局的一环。
百度在 AI IDE 上的决心
百度发布国内首个多模态、多智能体协同的AI IDE:Comate AI IDE。其功能完备,百度在AI IDE赛道决心大。随着模型和Agent能力提升,百度认为未来IDE竞争本质是Agent竞争,其早有相关布局。