冲突解决」共找到 2498 篇相关文章

算法论文8

ACM MM 2025 Oral | 新加坡国立大学提出FractalForensics,基于分形水印的主动深度伪造检测与定位

近些年来,深度伪造主动防御受关注,但现有方法有鲁棒性不稳定等问题。新加坡国立大学等团队提出 FractalForensics 方法,基于分形水印实现主动深度伪造检测与定位,实验效果良好。

机器之心
开源动态8

抖音SAIL团队联合港中文MMLab推出SAIL-Embedding:打通「视、文、音」的全模态嵌入

字节跳动抖音SAIL团队联合港中文MMLab提出SAIL - Embedding,专为大规模推荐场景设计,实现视、文、音统一表征,解决传统多模态模型局限,在抖音业务场景效果显著,相关技术报告已公开。

机器之心
产品应用8

大涨240%,Doc-Researcher确立多模态文档深度研究新范式

在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。

PaperAgent
算法论文8

少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了

现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。

机器之心
算法论文8

数据集蒸馏,连发两篇顶会!10%样本实现全量性能,鲁棒不失真

数据集蒸馏能让模型高效节能,WMDD和GUARD两项研究分别解决保留原始数据特性、提升模型对抗扰动能力问题。WMDD用Wasserstein度量保留几何特性,GUARD平滑损失景观获对抗鲁棒性。

新智元
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
算法论文8

一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%

北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与可扩展性。

量子位
算法论文8

比Transformer更强的架构来了?浙大新作Translution,一统卷积和自注意力

随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现自注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为新一代神经网络发展开辟新方向。

新智元
新闻资讯7

OpenAI以为GPT-5搞出了数学大新闻,结果…哈萨比斯都觉得尴尬

OpenAI研究员宣称GPT - 5找到10个厄尔多斯数学难题解法,引发全网震动。但DeepMind CEO哈萨比斯指出是营销过度,GPT - 5只是搜到已有答案。OpenAI已删稿,此前GPT - 5有一定数学解题能力。

量子位
开源动态8

狂涨14.4K star!大三学生开发的Github可视化利器,真吊!

开源君介绍`gitdiagram`,这是结合AI与Web开发栈的开源工具,能将GitHub仓库变成交互式架构图。由大三学生开发,获14.4k星标,微软等企业团队采用,性能佳、使用便捷。

开源先锋