新功能实现」共找到 6252 篇相关文章

算法论文8

CVPR 2025 | 如何稳定且高效地生成个性化的多人图像?ID-Patch带来解法

本文围绕个性化多人图像生成展开,指出其面临身份特征泄露等挑战。介绍了早期方法的不足,提出全的ID-Patch方案,阐述其设计思路、实验效果等,还探讨了提升空间与未来方向,该方案在多人物图像生成中有突破式提升。

机器之心
开源动态8

LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理时代

Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布基准测试,也透露了后续计划。

量子位
算法论文8

ICML 2026 | 突破3DGS光度多义性瓶颈:北航/国立提出AmbiSuR,重塑高保真3D几何重建

3D高斯泼溅推动神经渲染发展,但提取3D几何表面易失真,核心瓶颈是光度多义性。北航与国大团队提出AmbiSuR框架,从表征和监督层面解决问题,实验证明其在多数据集表现优异。

机器之心
开源动态8

狂涨 7.4K star!!一款堪称开源监控标杆的项目,谷歌、字节都点赞,牛皮!

介绍开源监控工具 Checkmate,它由 BlueWave Labs 开发,主打“自托管 + 全功能 + 易上手”,功能强大、性能卓越、灵活易用,已获 7.4K star,受大厂工程师青睐。还介绍了其功能特色、安装方法。

开源先锋
算法论文8

正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化「蓝海」

微软研究院联合多校发布论文,提出优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化方向。

机器之心
推荐文章7

基于一个MXFP8量化Kernel谈一谈如何在B200上实现高性能的Memory Bound Kernel

作者向SGLang社区提交基于CUTLASS的MXFP8 Blockscaled Grouped GEMM实现,其中包含量化Kernel。文章关注此Kernel,介绍在B200上实现高性能Memory Bound Kernel的优化技术,如整体设计、向量化与合并访问、Occupancy优化、TMA利用等。

GiantPandaLLM
新闻资讯8

谷歌NotebookLM终于说中文了!这可是最火的大模型播客产品

NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文播报且将推移动App。它能将音频源转化为类似播客的对话,有摘要等功能,音频概览功能受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。

机器之心
开源动态8

用 Warpgate(5.8k star)在不装客户端的情况下,如何实现透明审计、统一堡垒与会话回放?

Warpgate 是完全透明的 SSH / HTTPS 等堡垒解决方案,无需额外客户端。能部署在 DMZ,提供会话录制等功能,以单一可执行文件发布,用 Rust 编写。文章介绍其痛点场景、功能、架构、上手步骤、应用场景等。

小华同学ai
产品应用7

既然 Claude 封了不让用,Codex 就疯狂追赶之

Claude 受限,作者转用 Codex 等 Agent 工具,效率不错。OpenAI 加大 Coding 投入,Codex 追赶势头猛。作者还分享 Codex 使用心得,介绍为 CatReader 加功能过程,提醒加功能要谨慎。

MacTalk
算法论文8

MIT这篇RLM论文,给出了Scaling的另一种可能~

当大家普遍认为解决长上下文问题要靠扩大模型上下文窗口时,MIT 最的 RLM 论文提出路径。其 code 已开源,能实现无界上下文处理,可让任意大语言模型处理 10 万 +token。

PaperAgent