集合和差问题」共找到 8716 篇相关文章

算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理
新闻资讯7

这家国内公司,在给具身智能技术栈做「通解」

具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术多种落地形式,展示自研通用机器人「眼脑手」全栈技术产品,推动机器人各行业落地。

机器之心
产品应用7

为什么又是杭州?杭州初创团队打造全球第一个AI旅行伙伴

杭州初创团队打造的iMeanAI Coyage是全球首个AI旅行伙伴,能解决旅行规划中选择困难信息过载问题,如订机票、酒店、行程,经测试表现出色,还将开放多语言语音导览功能。

AI工程化
新闻资讯7

AI七个月突破数学家“围剿”反超人类!14位数学家深挖原始推理token:不靠死记硬背靠直觉

大模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得分从2%提升到22%,超人类团队平均水平。数学家分析其推理记录,发现它靠直觉而非死记硬背解题,但也存在缺乏创造力等局限。

量子位
推荐文章7

RAG系统设计:揭秘语义搜索被低估的核心价值与KG驱动的架构选型策略

在AICon大会上,Hugging Face的尹一峰探讨基于语义搜索的RAG系统重要性,揭示其被低估原因,分析本质与作用,分享设计高效架构方法,还讨论KG驱动的RAG系统及范式选择。

AI前线
产品应用7

姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人

腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升CodingAgent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。

量子位
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展迅速,现有检测方法难满足需求。最新综述提出「事实保真度验证」目标,梳理出视觉与语言双视角的四层检测框架,还分析了检测方法演进、评测指标数据集,为AI视频检测提供落地地图。

新智元
算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
新闻资讯7

微信龙虾只活2天:一次更新干崩全生态,OpenClaw 撞上 Vibe Coding 天花板

3月22日微信官宣推出支持接入OpenClaw的ClawBot插件,两天后OpenClaw更新,将插件生态系统迁移到官方ClawHub市场,引发诸多问题,如系统崩溃、插件失效等。此次事故暴露系统脆弱性,也为Vibe Coding发展敲响警钟。

InfoQ
推荐文章7

93%的人在用AI,为什么生产力只提升了10%——两个被严重低估的杠杆

Stack Overflow 2024年调查显示93%开发者用AI辅助工具,但DX Research研究表明生产力仅提升约10%。文章指出多数人用AI是线性叠加,真正的乘数效应来自自闭环验证长期记忆,还分析误区并给出实践路径。

AI Reading Hub