后训练阶段」共找到 4201 篇相关文章

新闻资讯7

突发!英伟达H200对华解禁,老黄赢麻了

特朗普拍板允许英伟达向中国出售H200,美确保“代差优势”,还抽25%分成。H200性能是H20的6倍,虽落最新架构,但适合训练推理,此决定或为英伟达带来巨额销售额。

新智元
新闻资讯8

英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛

本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。

新智元
7

Gemini 3,是谢尔盖・布林「骂」出来的?

ChatGPT 问世谷歌反应迟缓,创始人谢尔盖・布林回归,亲自写代码,推动 Google Brain 与 DeepMind 合并。他还因 Gemini 被禁止写代码在公司大吵。谷歌推出 Gemini 3 等,坐稳 AI 领域王座,给 OpenAI 带来压力。

机器之心
产品应用8

产品经理起飞!Google AntiGravity升级Nano Banana Pro,AI编程真的牛逼了

作者用Google新发布的AntiGravity生成海报,其升级增加Nano Banana Pro能力效果惊人。作者展示了用它生成高保真原型图、用户故事地图、用户旅程地图等案例,还提及更多应用场景及使用建议和限制。

AI产品黄叔
新闻资讯7

反超Gemini 3!马斯克放出Grok4.1快速推理版,还曝出了新一轮150亿美元融资

Grok4.1被Gemini 3反超,据华尔街日报爆料,xAI正计划150亿美元融资,公司估值将达2300亿美元。xAI成立两年多来估值飙升,马斯克还发布Grok 4.1 Fast击败Gemini 3。

量子位
产品应用8

GPT-5败下阵,这款中国AI拿下全球第一,众多医生已在用它做诊断

国家卫健委推进“人工智能+基层应用”,基层医生需实用AI助手。未来医生AI工作室的MedGPT在临床“安全”与“有效性”评测击败国际知名大模型夺冠,其两款助手获医生认可,被视为AI赋能基层医疗最佳实践。

量子位
7

AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出

在号称「史上最严管控AI」的顶级会议ICLR 2026上,超五分之一审稿意见由大模型一键生成。这发生在ICLR颁布史上最严LLM规定不久,引发诸多争议,也凸显AI改写科学评审分工的趋势。

新智元
开源动态8

RLinf上新πRL:在线强化学习微调π0和π0.5

近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。

机器之心
算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
新闻资讯7

OpenAI启动新实验,46万学生参与

硅谷巨头正秘密培养首批「AI原生代」,OpenAI等推动下,CSU欲成美国最大AI赋能大学,花费1690万美元采购OpenAI的Edu服务,引发是培养人才还是制造顺从AI机器的讨论。

新智元