预训练策略」共找到 2846 篇相关文章

算法论文8

CVPR2026满分论文:Proxy-GS为结构化3D高斯溅射引入统一遮挡先验

上海交通大学钟志航团队等在CVPR 2026提出Proxy - GS,面向基于MLP的结构化3D高斯溅射,用轻量级代理网格将遮挡关系变为可见性信号。在推理和训练阶段发挥作用,在遮挡密集场景实现渲染加速,画质与速度均优。

机器之心
算法论文8

SIGGRAPH Asia 2025最佳论文 | 港中大、曼彻斯特大学获奖

SIGGRAPH Asia 2025将“最佳论文奖”颁给港中大与曼彻斯特大学团队研究。该研究提出全新切片计算框架,把切片生成与路径规划转化为数学优化问题,解决传统DLP 3D打印难题,还介绍了进阶策略和实验结果。

机器之心
算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
算法论文8

StereoAdapter:北大首提自监督,适配水下双目深度估计

水下机器人深度感知难题待解,北大等机构提出StereoAdapter框架。它结合单双目视觉,以自监督学习适配视觉基础模型到水下域,设计双阶段结构、自监督训练策略等,实验效果好,未来还将多方面改进。

新智元
推荐文章7

诺贝尔经济学奖背后的 AI 投资主线|AGIX PM Notes

本文围绕诺贝尔经济学奖与AI投资展开。以创新驱动的增长范式与AI生产力、商业模式转型相关,还介绍本周全球股市去杠杆情况及AI领域动态,如Meta等公司技术进展,最后解读ETF市场价格与净值关系及投资策略

海外独角兽
开源动态8

让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO

腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
算法论文7

斯坦福:优化器「诸神之战」?AdamW 凭「稳定」胜出

斯坦福大学 Percy Liang 团队研究指出,虽有不少声称能显著加速的优化器替代方案,AdamW 仍为训练稳健首选,但矩阵型方法在特定数据–模型比例下优势明显。研究还揭示了现有研究的方法论缺陷。

机器之心
算法论文7

token危机解决?扩散模型数据潜力3倍于自回归,重训480次性能仍攀升

新加坡国立大学AI研究者Jinjie Ni团队训练扩散语言模型(DLMs)与自回归(AR)模型,发现DLMs是超强数据学习者,数据潜力超AR 3倍,重训480次性能仍攀升,还剖析同期研究方法论缺陷。

机器之心
开源动态8

南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B

南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。

AINLPer
开源动态8

The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战

阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。

DeeplearningAI