「零监督训练」共找到 2482 篇相关文章
The Batch: 973|Claude 的水印如何运作
Anthropic将在2026年8月2日后发布的Claude模型全球部署肉眼不可见、机器可读的水印,用于表明文本和图像由其生成。该技术基于Google的SynthID - Text,不过此公告引发广泛争议。
给机器人一个会预测未来的Critic,VLA强化学习直接起飞
OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。
CUDA 20年护城河一个周末崩了 !Claude独自跑通AMD新GPU
一个周末,Claude直接把自家最前沿模型跑在全新AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工具,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。
微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测
此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据集、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据集达SOTA,还给出实战代码案例。
解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”
大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。
上海AI Lab新研究:SFT能泛化,只要满足这三个条件
上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。
Hermes Agent抄袭中国团队代码实锤!被锤后回应:你删号
AI圈现教科书级开源抄袭事件,GitHub狂揽8.5万Star的Hermes Agent被指架构级抄袭中国团队EvoMap的Evolver引擎。EvoMap公开技术对比报告,实锤两者架构高度同构,而Hermes团队回应令人失望。
ICRA 2026|NUS邵林团队提出T(R,O) Grasp:刷新跨智能体灵巧抓取SOTA,实现5FPS动态环境交互
新加坡国立大学邵林团队提出T (R,O) Grasp,这是基于物体—机器手空间关系建模的图扩散架构,有跨智能体统一表征能力,在多种智能体上平均抓取成功率达94.83%,刷新跨智能体灵巧抓取SOTA。
打破视觉Token的算力诅咒,RedundancyLens如何为多模态大模型推理减负
多模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。
执行力通货膨胀的AI时代,什么才是你真正的资产?
在AI时代,执行力正在通货膨胀,劳动市场估值逻辑改变。文章指出判断力、品味、信任资本、意义感将成为稀缺资产,因AI在这些方面有局限。还给出提升这些能力的行动建议。