「联邦学习算法」共找到 1819 篇相关文章
CVPR史上首次!中国车厂主讲AI大模型,自动驾驶也玩Scaling Law?
世界计算机三大顶会之一CVPR 2025落幕,小鹏汽车作为唯一受邀车企,其世界基座模型负责人发表演讲分享成果。小鹏用强化学习打造‘AI大脑’,还自研‘世界模型’,从云到端全流程优化,展现中国车企在自动驾驶的创新实力。
半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远
现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。
Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键
Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。
Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统
Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。
MoE推理「王炸」组合:昇腾×盘古让推理性能狂飙6-8倍
在通往AGI进程中,MoE模型成大模型推理提效关键。华为推出Pangu Pro MoE 72B模型,经多方面优化,推理性能提升6 - 8倍。还采用多种策略和算法,在昇腾不同平台展现卓越性能,为大模型落地提供支撑。
AI产品先发优势在于用户迁移成本高,持续为用户提供价值是保持竞争优势的关键 | 对话AI智能电子衣橱工具搭搭
文章围绕AI智能电子衣橱工具搭搭展开,介绍其功能、开发逻辑与发展规划。搭搭通过AI算法筛选美图定义美,提供穿搭灵感,注重用户需求。团队投入研发,获客成本低,未来聚焦工具,解决穿搭问题,与用户共建产品。
4B小模型数学推理首超Claude 4,700步RL训练逼近235B性能 | 港大&字节Seed&复旦
香港大学NLP团队联合字节跳动Seed、复旦大学发布Polaris强化学习训练配方,让4B模型数学推理能力超商业大模型,且Polaris-4B可在消费级显卡部署,相关内容已全部开源。
AI改造激光焊接检测!“过杀”率暴降50%,国际头部客户产线已用上
在第三届国际供应链博览会上,广州德擎光学科技的激光焊接在线检测系统展示了AI+先进制造检测落地效果。基于深度学习的AI检测模型,使焊接检测“过杀”率降50%,产线检测精度和效率提升,已用于国际头部客户产线。
我所知道的闫俊杰
文章讲述了MiniMax掌门人闫俊杰的故事。他技术功底深厚,在商汤时提出创新算法成名。创业后,他以AGI为目标搭建人才体系,推出Glow等产品。虽面临DeepSeek竞争等困境,但坚持模型与产品一体化发展。
DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了
DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。