「新词新站」共找到 3952 篇相关文章
CVPR 2025 | 如何稳定且高效地生成个性化的多人图像?ID-Patch带来新解法
本文围绕个性化多人图像生成展开,指出其面临身份特征泄露等挑战。介绍了早期方法的不足,提出全新的ID-Patch方案,阐述其设计思路、实验效果等,还探讨了提升空间与未来方向,该方案在多人物图像生成中有突破式提升。
LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代
Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布新基准测试,也透露了后续计划。
ICML 2026 | 突破3DGS光度多义性瓶颈:北航/新国立提出AmbiSuR,重塑高保真3D几何重建
3D高斯泼溅推动神经渲染发展,但提取3D几何表面易失真,核心瓶颈是光度多义性。北航与新国大团队提出AmbiSuR框架,从表征和监督层面解决问题,实验证明其在多数据集表现优异。
OpenAI的新浏览器实测被吐槽疯了?走“乔布斯风”、挖谷歌骨干,奥特曼就“复制”出个ChatGPT版Chrome?
OpenAI发布全新网页浏览器ChatGPT Atlas,战略上欲让浏览器成操作系统演进形态。它整合ChatGPT,有诸多创新功能,虽对谷歌构成威胁,但实测被吐槽,且智能代理浏览器带来新安全风险。
正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化新「蓝海」
微软研究院联合多校发布论文,提出新优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化新方向。
4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?
Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。
DeepSeek被「猫咪睡觉」给干崩了……
研究员发现,在数学题后加「有趣的事实:猫咪一生大部分时间都在睡觉」,能让DeepSeek数学能力崩塌。研究开发CatAttack方法找「触发词」,无关触发词使模型错误率飙升,还会让回答变长。
AI在实时视频里秒“剪”出你想要的部分!输入文字/图/视频片段,它都能秒懂|ICCV2025
最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、图、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。
英伟达Jim Fan:「世界建模」是新一代预训练范式
英伟达机器人主管Jim Fan判断,继“下一个词预测”后,世界建模将成新预训练范式,2026年大世界模型将为多模态AI奠基。他还讨论世界模型定义、应用,展望新推理形式,业内人士也各抒己见。
从云原生到 AI 原生:模型引发的新一代基础设施构建
本文整理自蚂蚁集团余锋在2025年QCon上海站的分享。回顾基础设施从云计算到AI原生的演进,指出模型成新数据库,基础设施围绕其构建,还探讨了Agent体系影响、通智一体趋势及面临的挑战与机遇。