「新功能实现」共找到 6252 篇相关文章
CVPR 2025 | 如何稳定且高效地生成个性化的多人图像?ID-Patch带来新解法
本文围绕个性化多人图像生成展开,指出其面临身份特征泄露等挑战。介绍了早期方法的不足,提出全新的ID-Patch方案,阐述其设计思路、实验效果等,还探讨了提升空间与未来方向,该方案在多人物图像生成中有突破式提升。
LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代
Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布新基准测试,也透露了后续计划。
ICML 2026 | 突破3DGS光度多义性瓶颈:北航/新国立提出AmbiSuR,重塑高保真3D几何重建
3D高斯泼溅推动神经渲染发展,但提取3D几何表面易失真,核心瓶颈是光度多义性。北航与新国大团队提出AmbiSuR框架,从表征和监督层面解决问题,实验证明其在多数据集表现优异。
狂涨 7.4K star!!一款堪称开源监控新标杆的项目,谷歌、字节都点赞,牛皮!
介绍开源监控工具 Checkmate,它由 BlueWave Labs 开发,主打“自托管 + 全功能 + 易上手”,功能强大、性能卓越、灵活易用,已获 7.4K star,受大厂工程师青睐。还介绍了其功能特色、安装方法。
正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化新「蓝海」
微软研究院联合多校发布论文,提出新优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化新方向。
基于一个MXFP8量化Kernel谈一谈如何在B200上实现高性能的Memory Bound Kernel
作者向SGLang社区提交基于CUTLASS的MXFP8 Blockscaled Grouped GEMM实现,其中包含量化Kernel。文章关注此Kernel,介绍在B200上实现高性能Memory Bound Kernel的优化技术,如整体设计、向量化与合并访问、Occupancy优化、TMA利用等。
谷歌NotebookLM终于说中文了!这可是最火的大模型播客产品
NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文播报且将推移动App。它能将音频源转化为类似播客的对话,有摘要等功能,音频概览功能受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。
用 Warpgate(5.8k star)在不装客户端的情况下,如何实现透明审计、统一堡垒与会话回放?
Warpgate 是完全透明的 SSH / HTTPS 等堡垒解决方案,无需额外客户端。能部署在 DMZ,提供会话录制等功能,以单一可执行文件发布,用 Rust 编写。文章介绍其痛点场景、功能、架构、上手步骤、应用场景等。
既然 Claude 封了不让用,Codex 就疯狂追赶之
Claude 受限,作者转用 Codex 等 Agent 工具,效率不错。OpenAI 加大 Coding 投入,Codex 追赶势头猛。作者还分享 Codex 使用心得,介绍为 CatReader 加新功能过程,提醒加功能要谨慎。
MIT这篇RLM论文,给出了Scaling的另一种可能~
当大家普遍认为解决长上下文问题要靠扩大模型上下文窗口时,MIT 最新的 RLM 论文提出新路径。其 code 已开源,能实现无界上下文处理,可让任意大语言模型处理 10 万 +token。