「AI合照生成模型」共找到 10746 篇相关文章
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。
算力产业发展重心,正在改变
2025中国算力大会落幕,我国算力产业重心从规模扩张转向应用价值。数据基础设施筑牢底座,智慧运营平台奠定普惠基础,‘应用为王’成趋势,各方行动降低用算门槛推动AI落地。
Wassette:微软基于 Rust 构建的 Wasm 与 MCP 之间的桥梁
微软 Azure Core Upstream 团队发布 Wassette,它基于 Rust,搭建起 WebAssembly 组件与 MCP 间的桥梁,让 AI 智能体可自主获取和执行工具,还保障了安全,且未来有更多发展规划。
Jason Wei火速被挖走,奥特曼哭晕!OpenAI龙脉被挖,一亿刀偷走思维链之父?
OpenAI痛失思维链之父Jason Wei等核心员工,他们将加入Meta。此前Meta已多次从OpenAI挖人,扎克伯格全力推动Meta向AI转型,依靠自有资金布局,欲打造下一代科技霸权。
刚刚,OpenAI开放GPT-4.1偏好优化DPO,ChatGPT能真正学会你的「品味」了!
OpenAI宣布GPT - 4.1全系列模型支持DPO微调,可让AI通过对比回答学会用户偏好。介绍了DPO原理、适用模型、数据格式、创建任务方法等,还提及开发者反应与技术要点。
750篇论文,彻底把统一多模态模型摸清了
未来迈向AGI需多模态AI系统。南大等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。
2026 将近,世界模型到底更「世界」了吗?
近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。
知名机器人专家喊话:投人形机器人初创公司的数十亿美元,正在打水漂
知名机器人专家罗德尼・布鲁克斯质疑特斯拉、Figure等公司技术路线,称让机器人看人类视频学操作是‘空想’。他指出触觉数据无技术积累、安全有隐患,预测成功‘人形’机器人未来将大不同,投资难量产。
开源TTS语音新标杆!Kyutai TTS:350ms延迟碾压全场,词级时间戳重构!
法国AI实验室Kyutai开源高性能TTS语音模型Kyutai TTS,基于DSM框架,支持流式输入、超低延迟与高保真语音生成,有多项亮点,还给出不同使用方式及应用场景。
谢赛宁团队新作:不用提示词精准实现3D画面控制
谢赛宁团队新发布的Blender Fusion框架,结合图形工具 (Blender) 与扩散模型,让视觉合成不再仅依赖文本提示,实现精准画面控制。其核心是对现有技术高效组合,还透露两项训练技巧提升泛化性。