「端到端训练」共找到 4169 篇相关文章
YC 2026 Startup 复盘:硬件、数据的都在挣钱,应用团队开始自己训模型了
本文是YC核心团队基于过去12-18个月的创业项目数据,复盘AI创业生态的最新变化,拆解硬科技、软件、数据服务等赛道的新机会与趋势,为AI创业者提供方向参考。
AI办公工具实测红榜|打工人到底该留哪一款?
2026年AI办公赛道竞争焦点转向‘抢入口’,产品繁多让打工人选择困难。文章实测热门产品,分全能型、专项型、专业研究三类,横评各产品优势短板,还深度体验库库AI。
答对了却没看图?EASE给多模态RLVR装上「视线校正器」
强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。
The Batch: 973|Claude 的水印如何运作
Anthropic将在2026年8月2日后发布的Claude模型全球部署肉眼不可见、机器可读的水印,用于表明文本和图像由其生成。该技术基于Google的SynthID - Text,不过此公告引发广泛争议。
给机器人一个会预测未来的Critic,VLA强化学习直接起飞
OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。
吴恩达开源的OpenWorker,为什么「不 Work」了?
美国时间7月23日,吴恩达与Rohit Prasad发布开源桌面Agent OpenWorker。它把Agent工作流压缩成桌面应用,但上线一周暴露出多模型兼容、数据流向和权限控制等问题,反映出Agent赛道走向成熟产品的挑战。
CUDA 20年护城河一个周末崩了 !Claude独自跑通AMD新GPU
一个周末,Claude直接把自家最前沿模型跑在全新AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工具,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。
全球第一个「无人公司」来了:AI 开公司帮你赚钱,这件事终于有人跑通了
市面上 AI 工具多停留在帮用户做出产品,难以将其运营成生意。Flowith 团队的 Matrix 产品主打用 Agent 开「无人公司」,让 AI 完成调研、生产、发布、获客等工作,有望破局。
独家对话大晓机器人陶大程:具身机器人大脑,不必装下整个世界|甲子光年
甲子光年独家对话大晓机器人陶大程,探讨具身机器人大脑。陶大程提出控制充分状态,大晓用Kairos模型回应世界模型问题,强调行动后果建模,还谈了数据处理、技术风险及应用场景等。
上海AI Lab新研究:SFT能泛化,只要满足这三个条件
上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。