「科学多任务学习」共找到 3320 篇相关文章
速度提升,能力却暴跌?扩散模型做智能体的残酷真相
南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。
第二代AI预训练范式:预测下个物理状态
英伟达科学家 Jim Fan 发布《第二代预训练范式》,指出当前以 LLM 为代表的第一代范式应用于物理世界时「水土不服」,认为第二代范式是「预测下一个物理状态」,引发机器学习社区讨论。
上交大智能计算研究院论文:不只算对答案,大模型如何真正学会运筹建模丨ICLR 2026
上海交大智能计算研究院提出 StepORLM,通过生成式过程监督提升运筹建模可靠性。研究反思传统训练范式局限,在多数据集测试中,小参数的 StepORLM 表现超大型模型,还分析现有方法缺陷并提出解决框架,有重要方法论和应用意义。
天下苦CUDA久矣,又一国产方案上桌了
AI开发中,国产硬件增多,但开发者仍依赖进口生态。KernelCAT作为国产AI Agent应运而生,它能开发高性能算子,在昇腾芯片测试中表现出色,还能助力模型在国产平台高效迁移,限时免费内测。
让记忆学会“进化”:探索 LLM Agent 的运行时价值感知与自适应检索 | 直播预约
本次直播将介绍最新研究成果 MemRL,提出作用于情景记忆的运行时强化学习方法,使 LLM Agent 能判断记忆价值,检索高价值经验,提升复杂未知环境下泛化性能与任务成功率。
Github 7万星的Clawdbot实测:用国产模型做心脏,躺在床上指挥电脑干活。
本文实测了Github 7万星的Clawdbot(现叫Moltbot),介绍其能在本地运行,可多平台交互,有持久记忆、能控制浏览器等特点,还说明了安装配置过程,指出它虽有不足但想象空间大。
Clawdbot:火爆硅谷,让开发者疯抢Mac mini的AI新物种
Clawdbot是诞生仅三周的开源项目,让AI走出聊天框成数字同事。它由退休程序员Peter Steinberger推出,能24小时运行在本地电脑,解决AI落地难题。许多开发者为此抢购Mac mini。
卢宗青团队新作:人类先验打底,统一动作对齐,通用机器人模型正在落地
机器人行业核心问题是让机器在真实世界稳定行动。卢宗青团队论文《Being - H0.5: Scaling Human - Centric Robot Learning for Cross - Embodiment Generalization》给出通用操控路线,系统性解决多形态平台部署问题。
鹅厂员工都用AI Coding捅过多少篓子?
本文盘点AI Coding翻车现场及防坑指南,10位鹅厂同事分享用AI Coding捅过的篓子和防坑技巧,如选好模型、手动拆解任务、提前备份、限制危险操作等。
清华新研究,Nature+Science双杀!
清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。