训练策略」共找到 2783 篇相关文章

算法论文8

arXiv开始拒收综述论文了?「论文DDoS」这事,这篇NeurIPS论文早有讨论

近日,arXiv宣布拒收未通过同行评审的综述和立场性文章,危机源于生成式AI与大模型。上海交大团队中稿NeurIPS的论文,精准预见此危机,提出“综述论文DDoS攻击”概念,还给出应对策略

机器之心
算法论文8

谢赛宁新作:VAE退役,RAE当立

谢赛宁团队研究表明VAE时代结束,RAE将接力。RAE是用于扩散Transformer训练的新型自动编码器,能提供高质量重建结果,有语义丰富潜空间,支持可扩展架构,收敛快,在ImageNet图像生成效果强劲。

量子位
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
开源动态7

全新开源视频换装框架MagicTryOn

现有视频虚拟试穿(VVT)方法在时空一致性和服装内容保留方面有挑战,浙大提出全新开源视频换装框架MagicTryOn,利用全自注意力机制统一时空建模,设计服装保留策略,还引入掩码感知损失。

带你学AI
算法论文7

3D多光照场景渲染!GRGS带来真实感重光照

哈工大提出通用3D高斯框架GRGS,用于多样光照下高保真人体新视角合成。它采用前馈监督策略,支持可编辑光照,结合物理着色与神经网络推断,合成逼真效果,但处理透明材质和纤薄结构欠佳。

带你学AI
开源动态8

让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力

上海交大等团队推出多模态智能体训练方法 Visual-ARFT,让视觉语言模型有「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在多任务超 GPT-4o。

机器之心
算法论文8

新SoTA方法RM-R1:让reward model对评分说出原因!超越GPT4o

过去模型‘黑箱打分’不透明、不灵活。论文提出ReasRM,经两阶段训练,让奖励模型像人类先思考再打分。它能分任务类型、动态奖励,实验中碾压GPT - 4,小模型逆袭,团队已开源6个模型。

深度学习自然语言处理
算法论文7

科学家把大脑切片接上机械手,它自己学会了弹琴

法国国家科学研究中心等机构研究人员将死者脑切片放培养皿,连接机械手,经训练机械手学会曲子。研究证实学习依赖神经活动,虽成果距应用远,但为脑科学研究提供观察窗口,也引发伦理思考。

DeepTech深科技
推荐文章8

“我一行代码都没读就发布了”,被OpenAI收购后,uv工具创始人开始反思AI编程

Python 开发者工具领域经历革命,Charlie Marsh 打造 Ruff 和 uv 后被 OpenAI 收购。他反思 AI 编程,探讨其对软件工程的重塑,还分享开发、创业经验及应对 AI 挑战的策略

AI前线
新闻资讯7

GPT-5.2降智遭全网差评!奥特曼慌了

OpenAI推出GPT - 5.2,却未打赢谷歌。第三方数据显示Gemini 3 Pro更优,GPT - 5.2在多项基准测试表现不佳,可信度不如GPT - 5.1,遭开发者吐槽。OpenAI为此调整策略,但仍处被动。

新智元