「预训练数据」共找到 4014 篇相关文章
李飞飞押注的3D世界模型黑科技,被这篇论文一次性扒光!
李飞飞创业公司World Labs发布空间智能模型成果,推出Marble平台。本文分享3D、4D世界模型技术综述,系统梳理原生表示的世界模型,给出分层分类法、数据集与评测指标,并开源维护。
马斯克周末血裁xAI 500人
上周四晚,xAI内部突袭测试,淘汰率达33%,超500人被裁。此前其数据标注团队规模持续增长,多为直聘。此次战略转变,将扩专业标注员规模,或押注垂直行业AI。
字节开源图像生成“六边形战士”,一个模型搞定人物/主体/风格保持
字节UXO团队设计并开源统一框架USO,解决图像生成多指标一致性问题。它能统一看似孤立任务,实现单任务和组合任务的SOTA,弥补了主体保持和风格迁移短板,性能领先,还采用新范式及算法。
Google Nano Banana 与 GPT-4o Image 1:哪款 AI 图像生成更好?
2025年8月26日,Nano Banana发布引关注,而GPT - 4o Image 1是主流常用图像生成器。文章从关键指标、生成速度对比二者,又用相同提示词在多种场景对比,分析各有优劣,适用场景不同。
突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!
近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。
全球第一!西湖大学成功登顶Science,卷赢同行背后黑科技揭秘
西湖大学一篇论文登顶Science,力压4篇同主题投稿。其成功除科研人员实力,还靠曙光存储支持。曙光为其AI集群升级,提供单节点带宽150GB/s的存储方案,且已大规模落地科研领域。
麻省理工 NANDA 研究发现,只有 5% 的组织把 AI 工具大规模用于生产
麻省理工 NANDA 报告指出,95%企业组织的 AI 投入无回报,仅 5%将 AI 工具规模化用于生产。原因是 AI 系统存数据、适应变化及持续学习能力不足,领导层对 AI 项目信心下降。
Cloudflare 选择 PostgreSQL 扩展而不是专用的 OLAP 来进行 100K 行 / 秒的分析
Cloudflare工程团队解释选TimescaleDB而非ClickHouse为内部平台增分析报告功能的原因,强调存储分析与配置数据简单性和专用OLAP系统性能的“惊人平衡”,介绍了项目发展及TimescaleDB优势。
全球首个人形机器人通用视觉感知系统,Humanoid Occupancy建立多模态环境理解新范式
北京人形机器人创新中心推出 Humanoid Occupancy 感知系统,创新性融合多模态传感器信息,构建通用感知框架。它以语义占用表征为核心,有全编码和适配融合优势,经实验验证性能优,推动机器人迈向通用感知时代。
2025 年中丨大模型市场分析报告
这是《2025年中丨大模型市场分析报告》。指出基础大模型塑造计算未来,企业重心转向推理。Anthropic超OpenAI成市场头号玩家,开源模型采用趋缓,企业换模型重性能,AI支出从训练转向推理。