后训练策略」共找到 4329 篇相关文章

产品应用8

英伟达推出下一代计算平台Rubin:可用45°C的热水进行冷却,训练速度提高3.5倍

英伟达黄仁勋在CES演讲,宣布进入自动驾驶领域、推出Alpamo模型与下一代计算平台Rubin。他指出计算行业正经历平台性转变,还介绍AI进展、应用架构,Rubin平台性能强且能效高。

AI寒武纪
算法论文8

北航团队提出新的离线分层扩散框架:基于结构信息原理,实现稳定离线策略学习|NeurIPS 2025

北航彭浩团队提出SIHD框架,基于结构信息原理,自适应构建多尺度扩散层级,实现稳定离线策略学习。通过构建状态拓扑图、用结构信息增益引导扩散、引入结构熵正则化器,在D4RL测试中表现出色。

AI前线
开源动态8

让AI打游戏!能玩1000多款游戏,英伟达用4万小时视频训练出通用基础模型NitroGen

NVIDIA发布NitroGen模型,利用40000小时带按键显示的游戏视频,构建视觉-动作数据集,训练出能玩超1000款游戏的通用基础模型,在跨游戏泛化和微调任务中表现卓越,为具身智能发展提供新思路。

AIGC开放社区
新闻资讯8

断腿也能跑!97小伙研发乐高式机器人,每个模块独立自主,断臂秒变三脚怪兽继续狂奔

近日,美国西北大学博士生余琛团队研发出全新模块化机器人,由独立智能腿模块组成,能像乐高自由组合,可在复杂户外奔跑,断腿也能继续前进,在多领域有应用潜力,相关论文已发表。

DeepTech深科技
新闻资讯7

DeepSeek一句话让国产芯片集体暴涨!背的UE8M0 FP8到底是个啥

DeepSeek V3.1发布,官方留言提及新架构和下一代国产芯片,引发AI圈轰动,国产芯片企业股价上涨。文章介绍了UE8M0 FP8概念,分析其适配国产芯片原因,还猜测适配的芯片厂商,指出代表国产AI走向软硬协同。

量子位
新闻资讯8

从 AI Agent、RLHF 到 MoE 大规模训练:AMD 这场开发者日,把一线实战话题凑齐了 |Q推荐

AMD AI开发者日揭晓八大硬核GPU Workshop、技术专题及“作品说话”主题分论坛嘉宾与话题,覆盖AI Agent、RLHF、MoE大规模训练等前沿领域,还有多场实操分享。

InfoQ
产品应用7

王兴兴亲测点赞!这家AI公司提前半年把“龙虾”能力带上车,还管住了Token黑洞

宇树科技王兴兴体验宝马新世代 i3 智能座舱称赞,其核心技术来自斑马智能“元神 AI”。斑马智能发布“元神 AI 汽车机器人大脑”等,对“元神 AI”升级,明确交流和办事方向,还管控 Token 等挑战。

AI前线
新闻资讯8

李飞飞团队发布新一代世界模型Atlas:从零训练,一次性打通视频生成、 3D重建与机器人仿真

李飞飞创办的 World Labs 发布新一代世界模型 Atlas,称其为‘全球首个多模态世界模型’。它从零训练,能同时完成视频生成、3D 重建和时空模拟,已向少数伙伴开放测试,未来将成 Marble 底层模型。

DeepTech深科技
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论
推荐文章8

给非技术人的大模型介绍:从零训练ChatGPT的全流程、天价成本及企业务实替代方案

文章介绍从零训练ChatGPT级别大模型的全流程、高昂成本,指出这对多数企业不现实。建议企业战略从构建转向应用,通过租用API或微调开源模型利用大模型,将专有数据视为核心资产。

AI Reading Hub