「训练可用度」共找到 5638 篇相关文章
蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据
蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中大幅缩短周期。
告别「利用率崩溃」:GIPO开启大模型强化学习高效训练新方法 | ICML 2026
树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及大语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。
Apple | 开源视觉语言模型:FastVLM,可手机运行,首token速度提升 85 倍
苹果开源能在 iPhone 上运行的视觉语言模型 FastVLM,代码仓库含 iOS/macOS 演示应用。它解决体积和速度问题,首 token 输出速度提升 85 倍,引入 FastViTHD 编码器,适配 iOS/Mac 生态,有不同参数量级版本。
Claude推出Agent View:一次管理所有编码会话
Anthropic为Claude Code新增Agent View功能,可集中管理编码会话,已开放研究预览。开发者操作路径清晰,早期用户总结出实用玩法,解决了常开多任务的切换难题,目前部分计划可体验。
字节开源了一个让人上头的 Context 项目
字节开源 MineContext 项目,是其“三步走”开源策略首步。它能自动收集屏幕上下文、生成日报待办等,还可深度分析。其理念为主动洞察、无负担收集,未来 OpenContext 开源后开发者可搭建应用。
微软开源了一款 skill 神器,这下爽了!
近期微软开源桌面应用 `Skill Recorder`,1个多月揽3K star。它能录屏幕操作,借助 GitHub Copilot CLI 生成可复用 Skill 或 Automation,与 RPA 思路不同,有泛化能力,可按命令快速安装。
炸裂黑科技,脑波沟通来了!AlterEgo让你在大脑中发声
AlterEgo是一种非侵入式、可穿戴的外围神经接口,能让人用自然语言与机器等交流,无需发声。它始于2018年MIT媒体实验室,2025年初独立运营,可用于帮助语言障碍者,还能融入日常生活。
Vercel 推出 Drains 功能:实现统一数据导出
Vercel 发布 Drains 系统,将平台可观测性数据统一导出至外部服务,覆盖多来源日志等。用户可两种方式配置,导出数据与多系统兼容,能简化接入流程、减少管道碎片化。
AI 互动游戏的 GPT 时刻到了!谷歌Genie 3首测!太牛了!
谷歌去年发布世界模型Genie 3,支持实时生成可交互视频内容,因成本高未开放。现美国18岁以上Ultra用户可试玩,其操控延迟低、画面清晰、物理交互真实,还介绍了操作流程等。
强化学习的进化:从PPO到MaxRL,LLM推理训练的算法演进史
本文概述2024 - 2026年推理LLM的强化学习进展,从REINFORCE和PPO讲起,介绍GRPO、RLOO等多种算法。指出critic模型非必需,标准差归一化有副作用,损失聚合很关键,信任域是优化切入点,还提出几个未解决的挑战。