智能体训练」共找到 5184 篇相关文章

新闻资讯7

机器人商店来了!陶朱新造局十一亮相首钢园!

10月1日,陶朱新造局智能验空间将在首钢园新商业R+生活中心开放。其命名源于商圣范蠡智慧,以“古意新造”为理念,设多个功能区,展示科技成果,让观众智能便捷。

首钢园
算法论文8

10个小模型并联跑赢GPT-4.1!无额外训练,方法仅4步

上海人工智能实验室等机构提出Avengers框架,无需额外训练,通过四步集结小模型优势。实验表明,其在15个数据集上平均得分超GPT - 4.1,还探究了框架有效的要素,对AI研究和开源社区意义重大。

量子位
推荐文章7

如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性

文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性与稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。

AI前线
算法论文8

蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据

蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中大幅缩短周期。

量子位
算法论文8

告别「利用率崩溃」:GIPO开启大模型强化学习高效训练新方法 | ICML 2026

树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及大语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。

AI科技大本营
新闻资讯8

2025 WAIC落幕,深谋科技异军突起,以技术与落地破局具身智能赛道

2025 WAIC落幕,深谋科技作为精英合作伙伴首次亮相,未随波逐流,而是切入脑控、动态视觉伺服和康养场景三大底层能力领域,开拓创新赛道。其产品已商用部署,吸引众多媒关注。

AI科技评论
算法论文8

AI 的本质不是算力,而是「上下文革命」

上交大刘鹏飞团队提出人工智能本质是“上下文革命”,在论文中把“上下文”提升为智能系统核心结构,提出“上下文工程”学科框架,通过实验揭示智能发展规律,为AI发展指明新方向。

AI科技评论
算法论文8

端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统

北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。

机器之心
新闻资讯7

突发!卡帕西宣布入职Anthropic

大神Karpathy宣布加入Anthropic,重回一线大厂。他曾多次在AI领域转换角色,此次将加入预训练团队,开展用Claude加速自身预训练研究。外界揣测其离开OpenAI原因,加入Anthropic能为研究提供更多资源。

量子位
新闻资讯8

机器狗腿被锯了也能继续走!最新机器人大脑来自320亿估值独角兽

Skild AI推出Skild Brain机器人大脑,它在虚拟环境训练相当于一千年时间成型。此模型没在对应机器人训练,控制能力是涌现的,能应对肢断裂、马达卡住等情况,还可完成精细动作。

量子位