后训练系统」共找到 5104 篇相关文章

新闻资讯8

黄仁勋迟到了15分钟,然甩出一个数字:1万亿美元。

GTC 2026上,黄仁勋获“Token之王”称号。他预计英伟达到2027年营收至少1万亿美元,还展示商业定价模型,推出Vera Rubin系统,整合Groq芯片,开源OpenClaw,预告Feynman架构,开发太空数据中心。

探索AGI
新闻资讯7

比互联网泡沫惨17倍!AI裁员潮上万科学家下一站在哪里?

《Nature》文章讨论AI泡沫破裂,OpenAI、谷歌等公司科学家流向,认为或重回学术界或创业。虽有裁员震荡,但长期看或使AI人才与技术溢出到其他领域。

新智元
推荐文章7

中国AI突破「造芯方法论」!Agent军团接管芯片设计全流程

RSI成人工智能前沿方向,芯片设计因有确定性验证体系,成其率先落地赛道。NovaSilicon完成融资,探索出芯片设计智能系统,发表论文介绍构建运行方法,将重塑行业。

新智元
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
产品应用7

grok 4一图流

文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。

AI寒武纪
推荐文章8

Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础

著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。

机器之心
产品应用8

Uber Hive 联邦架构:1.6 万数据集、10PB 数据去中心化,支撑大规模分析零停机

Uber重新设计Hive数据仓库,将超16000个数据集、超10PB数据去中心化部署,解决可扩展性等挑战。采用基于指针方案迁移,系统含四大组件降低运营风险,还减少存储开销,提升生态弹性。

InfoQ
推荐文章7

ACL'25首届博士论文奖 | 重新思考 LLM 中的数据使用

近日,第一届 ACL 计算语言学博士论文奖获得者是 Sewon Min,其论文《重新思考大型语言模型中的数据使用》围绕大型语言模型如何使用训练所用的庞大文本语料库展开研究。

PaperAgent
算法论文7

SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%

文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。

CourseAI
算法论文8

Agent 走向具身世界:从语言智能到机器人「大脑指挥官」

华为诺亚方舟实验室发布 RoboHarness 系统,解决不同策略协作问题。它将独立控制系统封装成可调度技能,由 Coding Agent 决策,还设计辅助技能和 Memory Bridge 模块,促进策略协同,推动具身智能发展。

AI科技评论