动作预训练」共找到 2406 篇相关文章

7

奥特曼怕了!GPT-5.5「大蒜」决战谷歌,红色警报紧急拉响

三年前ChatGPT让谷歌恐惧,如今OpenAI被谷歌逼得拉响‘红色警报’。OpenAI计划发布新推理模型,‘Garlic’训练有突破,还启动下一代模型。OpenAI调整策略,聚焦提升ChatGPT体验。

新智元
新闻资讯8

黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿

在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。

量子位
算法论文8

OpenAI解释LLM为什么会有幻觉

OpenAI和佐治亚理工联合论文《Why Language Models Hallucinate》深入探讨LLM幻觉根源,指出训练阶段统计本质和评估体系激励扭曲是主因,还提出改革评估体系引入显式置信度目标的解决方案。

深度学习自然语言处理
开源动态8

智源研究院发布中英文高质量数据集CCI4.0,推动全球人工智能开源创新

2025年5月6日,智源研究院在全球开源创新论坛发布中英文高质量数据集CCI 4.0,同步在多平台开源。CCI 4.0规模大,处理严格,此前CCI系列反响好,未来将持续建设中文训练语料库。

AI科技大本营
算法论文8

任务级奖励提升App Agent思考力,淘天提出Mobile-R1,3B模型可超32B

现有Mobile/APP Agent依赖动作级奖励,难应对变化环境。淘天集团团队提出Mobile-R1框架,采用三阶段训练,结合任务级奖励,实验显示其表现超基准,团队还计划开源资源。

量子位
算法论文7

何恺明改进了谢赛宁的REPA:极大简化但性能依旧强悍

扩散生成模型在建模复杂数据分布表现出色,但与表征学习领域关联不大。谢赛宁团队提出REPA,不过较麻烦。何恺明团队提出Dispersive Loss,简化且性能强,无需训练等,适用于多种模型。

机器之心
开源动态7

从文心开源谈起,论大模型发展新生态

6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。

AI科技大本营
开源动态8

Karpathy再放大招:8000行代码复现ChatGPT全栈,最低成本仅100美元,4小时跑完

Andrej Karpathy发布项目nanochat,是全栈式ChatGPT克隆体训练/推理流水线,代码约8000行,覆盖训练分词器、训练等完整流程。介绍不同成本下模型表现,还回答网友关于架构、训练数据等问题。

AI寒武纪
新闻资讯7

突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌

消息称Anthropic本周将发布Opus 5.1,其升级聚焦单Token智能水平,强化编程、推理、AI Agent能力;OpenAI 10万亿参数模型Bel完成训练;企业选模型‘够用就好’,Anthropic Fable 5份额低。

新智元
新闻资讯8

智源悟界·Emu3.5发布,开启“下一个状态测”!王仲远:或开启第三个 Scaling 范式

2025年智源发布悟界·Emu3.5,在“Next-Token Prediction”基础上实现“Next-State Prediction”。它能力全面提升,或开启第三个Scaling范式,还在训练、强化学习、推理加速上有技术创新。

AI前线