理论 - 实验学习范式」共找到 2543 篇相关文章

新闻资讯8

全球第一AI科学家天团,首战封神!2.5个月找到治盲新药,医学圈震撼

世界首个AI科学家天团发布首个成果,2.5个月发现治疗失明新药。AI包办写论文全过程,人类只需执行实验。团队推出全自动化多智能体系统Robin,将开源代码,它可跨领域应用,标志科研新范式诞生。

新智元
算法论文8

ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。

机器之心
算法论文8

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。

机器之心
算法论文8

YOLOv8-SST:水面小目标检测极致改进,降低漏检

浙江水利水电学院董慧贞团队提出YOLOv8 - SST算法,针对水面小目标检测的噪声干扰、定位不准、泛化能力弱三大痛点分别改进。经实验,该算法提升了检测精度,推理速度也能满足实时需求,还给出了实战代码。

机器学习AI算法工程
新闻资讯8

Kubernetes v1.36 发布:安全默认配置强化,AI 工作负载支持日趋成熟

Kubernetes发布1.36版本,代号Haru,含70项增强功能。聚焦安全加固、AI和机器学习工作负载及API可扩展性。如用户命名空间等安全功能达GA,AI方面适配工作负载需求,还引入新功能,同时移除部分旧功能。

InfoQ
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究

传统高保真CFD模拟计算资源消耗大,现有深度学习方法处理三维流场重建面临挑战。本文提出物理约束双并行注意力UNet++框架,实验表明其在流场重构精度上较传统U - Net提升约10%,预测速度提升2 - 3个数量级。

力学与人工智能
算法论文8

具身智能奇点已至!超越π*0.6,极佳视界自我进化VLA大模型拿下世界第一

极佳视界具身大模型 GigaBrain-0.5M*依托世界模型实现自我进化,在多真实任务近 100% 成功,超 π*0.6 成 SOTA。其提出基于世界模型的强化学习范式,用超万小时数据训练,推动通用具身智能发展。

新智元
算法论文8

停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它

这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。

深度学习自然语言处理
算法论文8

中科大 × 华为联合突破!SparseRM:1% 参数实现 LLM 偏好建模高效革新

中科大与华为联合提出SparseRM轻量级偏好建模方案,基于稀疏自编码器构建低参可解释奖励模型。实验显示它用不到1%可训练参数,在多任务中性能优,还能融入下游对齐流程,为LLM高效对齐提供新可能。

深度学习自然语言处理