「动态无偏学习框架」共找到 2997 篇相关文章
Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率
当前主流大模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。
DeepSeek推理再提速80%,V4正式版定档7月中旬
DeepSeek两天前开源DSpark推理加速框架,已在V4预览版在线服务跑真实流量,使生成速度提升60% - 85%。DSpark化解推测解码问题,在多模型超Eagle3和DFlash。V4正式版7月中旬上线,将引入峰谷定价。
CVPR 2026 | 还在为AI「鬼画符」发愁?TextPecker即插即用破解文字渲染难题
在生成式AI浪潮中,视觉文本渲染仍是未攻克的核心难题。华中科技大学白翔教授团队等提出TextPecker,是基于结构感知的即插即用型强化学习优化策略,可适配主流生成器,提升视觉文本渲染性能,已被CVPR 2026接收。
OneSearch,揭开快手电商搜索「一步到位」的秘技
本文介绍快手提出的电商搜索端到端生成式框架 OneSearch。它有三大创新,包括 KHQE 模块、用户行为序列注入策略、偏好感知奖励系统。实验显示它在多方面提升显著,已部署于快手电商搜索场景。
腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告
腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等多任务。基于openai - agents构建,适配多种模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。
一粒「扣子」,开启了Agent的全生命周期进化
2025年被视为Agent爆发元年,自年初通用Agent产品Manus出现后,其受关注程度空前。火山引擎Force 2025大会上,升级后的扣子成焦点,它从开发平台进化为全生命周期平台,覆盖开发、框架、调优、协作四大部分。
专访火思动力Kevin Ding:未来选择Agent,要看它过去三十天学会了什么|甲子光年
本文是对火思动力创始人Kevin Ding的专访。他指出当下Agent会工作但不会成长,而如今市场需求、技术条件和数据供给成熟,可开展持续学习。他还阐述了后训练、产品应用、商业化等方面观点。
转载 | 鄂维南院士:关于推动AI从工程化走向科学化的一点思考
鄂维南院士探讨推动AI从工程化走向科学化。回顾AI先驱,指出基础理论滞后致发展起伏、大模型开发依赖经验。介绍AI主要方法,分析深度学习基础理论问题,强调从系统角度看待AI,认为已到科学化转折点。
人大高瓴孙浩团队发表Nature子刊封面文章:基于并行符号枚举的物理定律发现
中国人民大学高瓴人工智能学院孙浩教授团队在《自然 - 计算科学》发表封面论文。提出PSE框架解决符号回归瓶颈,通过公共子树复用和GPU并行提升评估效率,实验表现优于现有方法,也指出了局限性与未来方向。
这个情人节,AI深吻Math!国产RL系统多维突破300年亲吻数难题
2月14日情人节,上智院等联合研发的PackingStar强化学习系统,在多维度刷新亲吻数与广义亲吻数纪录,实现数学结构领域多维度、系统性突破。它将复杂几何问题转化为可训练游戏,成果获权威认可。