点监督」共找到 925 篇相关文章

算法论文8

ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链

随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。

机器之心
开源动态8

阿里云通义金发布DianJin-R1金融领域推理大模型,32B模型荣膺榜首

阿里云通义金团队与苏州大学合作推出DianJin-R1金融领域推理大模型,介绍其开源数据集与模型、基于通义金平台的数据合成,展示了其在性能测试中的优异表现,推动金融科技智能化进程。

机器之心
算法论文8

同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等

中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。

量子位
新闻资讯8

2026:ASI奇之年!

马斯克断言2026是奇之年,称AI发展如超音速海啸。从AI编程能力提升、任务时长指数级增长,到‘品味奇’概念提出,各方面迹象显示AI正深刻变革各行业。杨静与李建忠对谈探讨了ASI奇相关话题。

新智元
产品应用7

秘塔 AI,悄咪咪上线「今天学啥」App

作者受手机厂商将AI功能做成NFC卡片启发,提出把知识载体变成Agent的想法。秘塔AI观与其不谋而合,还将「今天学啥」做成独立App,可个性化学习,体验超预期。

特工宇宙
新闻资讯7

再见,程序员!马斯克宣判:奇就在2026

马斯克断言2026年是奇之年,起因是Claude Code强大的编程能力引发关注。Claude Opus 4.5表现优异,碾压其他模型。奇来临,人们工作方式将改变,AI或使软件开发自动化。

新智元
开源动态8

The Batch: 873 | 通过自监督学习实现更好得图像处理

Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。

DeeplearningAI
开源动态8

极客大神构建了LLM架构画廊,AI大神Karpathy

极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy赞。画廊高度视觉化、互动性强,展示模型架构图及核心参数,源数据开源。

AIGC开放社区
新闻资讯7

720次攻击0成功!Claude Code默认放权,AI替你「同意」

本周五起,Claude Code在新会话默认让AI替用户「同意」。其开发者底气源于720次攻击0成功测试。不过业内人士对此不乐观,且测试有局限性,审批权移交AI有风险。

新智元
算法论文8

超越对数似然:模型能力连续体下的监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型后训练提供新优化方向。

深度学习自然语言处理