「预训练时代」共找到 3275 篇相关文章
李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!
李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。
SPIRAL:零和游戏自对弈成为语言模型推理训练的「免费午餐」
新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。
豆包是如何炼成的?字节放出自研万卡训练系统ByteRobust论文
文章介绍字节跳动的LLM训练基础设施ByteRobust。它由控制和数据平面构成,关键目标是获高ETTR。该系统优先快速隔离故障、考量人为错误、控制恢复可变性,已部署超一年,效果显著。
当AI迈入Harness时代:以MiniMax为样本看智能体云端新基建
2026年初,随OpenClaw爆火,AI步入Harness时代,MiniMax成变革焦点,推出MaxClaw和MaxHermes。但本地单机框架用于企业级生产有鸿沟,MiniMax借助阿里云云原生方案重塑Agent运行底座。
无需训练的3D生成加速新思路:西湖大学提出Fast3Dcache
在AIGC浪潮中,3D生成模型虽进化快,但‘慢’和计算量大制约其应用。西湖大学AGI实验室提出无需训练、即插即用的Fast3Dcache框架,能在加速同时保持或提升模型几何质量。
开源即屠榜!UniME多模态框架登顶MMEB全球训练榜,刷新多项SOTA纪录
格灵深瞳等团队联合发布通用多模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在多任务达SOTA,项目已开源。
LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收
LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。
谷歌Chrome觉醒!Gemini 3全面接管,38亿用户一夜进入Agent时代
谷歌官宣所有桌面端Chrome浏览器接入Gemini 3,38亿用户的浏览器进化为全能AGI入口。此次更新改变人机交互方式,Chrome具备多种智能功能,如自动浏览、调用全家桶服务等,开启AI驱动的浏览时代。
Agent 原生开发时代到来,Google Cloud Next 26 给开发者带来了什么
Google Cloud Next 26 大会热度高涨,反映行业对 Agent 原生时代的关注。Google Cloud 展示了云产业从 Cloud Native 到 Agent Native 的三层同步转换,还推出一系列 Agent 开发和管理套件,解决开发者关键问题。此外,大会亮点 A2UI 解决交互层 Agent 化。
中国移动副总经理陈怀达:AI时代,真正的竞争力不在于单一技术的领先
10月19日,中国移动副总经理陈怀达在2025世界VR产业大会演讲指出,VR与AI深度融合,‘AI+’时代有‘三个加速融合’趋势。他还提出关注方向,分享了中国移动‘VR+AI’融合发展体系实践。