「AI数据」共找到 11050 篇相关文章

算法论文8

首次结合RL与SFT各自优势,动态引导模型实现推理⾼效训练

新一代大型推理模型在复杂推理有进展,核心是ZERO - RL训练法。华为香港研究所小艺团队等合作推出GHPO算法框架,融合在线强化学习与模仿学习,解决了RLVR方法局限,提升模型训练效果,代码数据开源。

机器之心
新闻资讯7

卡帕西点赞特斯拉餐厅,马斯克:兄弟,你再回来吧

特斯拉餐厅太火,原特斯拉AI大神Karpathy点赞,马斯克邀其回归。餐厅有机器人员工、超级充电站,组合引关注。不过营业首日擎天柱出事故,且目前擎天柱发展混乱,马斯克却计划让它2026年当送餐员。

量子位
新闻资讯7

Mistral的首个强推理模型:拥抱开源,推理速度快10倍

本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。

机器之心
算法论文7

在Think中边搜索边调整的搜索增强Reasoning方法

LLM虽知识丰富,但无法掌握训练数据外的信息,传统检索增强生成方法有缺陷。AutoRefine提出“先筛选,再回答”理念,用强化学习训练,实验显示在多方面碾压传统方法,未来或改变知识密集型任务解决方式。

深度学习自然语言处理
开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
产品应用8

π0.7的泛化能力有多强?零样本纯靠口述就能用空气炸锅,演示完换个机械臂也能叠衣服

2026年4月16日,美国明星机器人AI公司Physical Intelligence发布模型π0.7。它具组合泛化能力,借助多模态提示框架,能零样本完成新任务。在空气炸锅、叠衣服等实验中表现出色,有望推动具身智能发展。

DeepTech深科技
推荐文章7

长尾的复兴

作者曾认为3D打印在制造业是旁支末流,天花板低。如今看法转变,认为AI加3D打印将长尾从比特推进到原子,长尾社区也成熟,让小众需求有规模化满足可能,创客和业余爱好者迎来复兴。

乱翻书
算法论文8

好看不等于会交互!阿里发布基于交互的世界模型基准

阿里等联合推出 Omni - WorldBench 评估框架,指出多数高颜值 AI 视频在物理规律和交互逻辑上有缺陷。该框架含提示词套件和量化评估框架,对 18 款模型测评,为 4D 世界模型研发指明方向。

AIGC开放社区
开源动态7

给 OpenClaw 装上“全网眼睛”:我把这个 3K+ Star 项目果断集成到了个人skills里。

作者用OpenClaw /Claude Code读推特遇难题,各平台上网关卡多。后发现开源2天获1.1K Star的Agent - Reach项目,将上网工具统一打包,技术选型实用,强调AI时代想法和判断力比技术重要。

AI进修生
新闻资讯7

揭密MiniMax不为人知的B面

第一批AI大模型公司上市潮来临,MiniMax营收增长显著。它采用“B+C全都要”商业模式,B端业务靠API调用,覆盖多领域,毛利率高。其B端战略分三层,靠全模态布局和模型能力扩张版图。

芯师爷