工作成果验证」共找到 2402 篇相关文章

算法论文8

RL成本降幅超90%!Meta提出Agent训练新范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。

深度学习自然语言处理
开源动态8

清华、北大,上海交大等发布人机协同训练框架,让机器人零样本学会新技能

清华、北大等发布人机协同训练框架MotionTrans,能让机器人零样本学会新技能。它将人类数据翻译成机器人语言,构建数据集,经格式转换、速度调整等处理后训练模型,实验验证其有效性,且数据、代码和模型已开源。

AIGC开放社区
算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。

深度学习自然语言处理
新闻资讯8

快手解密「AI印钞机」,首提生成式强化学习出价技术,为平台实现超过3%的广告收入提升

文章介绍快手首提生成式强化学习出价技术,为平台提升超3%广告收入。还阐述广告自动出价挑战及业界方案,介绍快手GAVE和CBD算法破解难题,其团队成果丰硕,未来技术有两大演进方向。

机器之心
新闻资讯7

腾讯披露元宝已是TOP3应用

2025腾讯全球数字生态大会信息量大。腾讯元宝日活冲前三,混元3D建模精度提升3倍。C端产品逐步落地B端,如腾讯云CodeBuddy等。腾讯云还将带成熟生态出海,投资1.5亿美元在沙特建数据中心。

量子位
产品应用8

最高提效8倍!腾讯游戏发布专业游戏AI大模型,美术师做动画不用辣么“肝”了

在Devcom开发者大会上,AI成焦点。腾讯游戏发布游戏创作AI全链路解决方案VISVISE,含动画制作等四大管线,能辅助美术完成重复工作。如MotionBlink可自动补帧,GoSkinning已在多游戏应用,提升了制作效率。

量子位
新闻资讯8

训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法

将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
算法论文8

SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能体,更少计算,更强性能

在多模态大模型加持下,纯视觉GUI智能体成通用操作智能体重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。

AI科技评论
新闻资讯7

Hinton预言成真,美国大学生掀起本科辍学潮!月入万刀修马桶,不怕AI裁员

美国Z世代不少放弃大学梦投身蓝领行业,因大学学费高、毕业易失业,且AI冲击白领岗位。蓝领工作起薪高、机会多,不易被AI取代,如焊接、水管工等。微软还列出易被AI取代的职业名单。

新智元
开源动态8

开启RL Scaling新纪元,siiRL开源:完全分布式强化学习框架,支持超千卡规模高效训练

传统强化学习框架在模型和集群规模达上千块GPU时,存在扩展性瓶颈和效率低下问题。上海创智学院团队推出siiRL,采用全分布式架构和多控制器范式,解决传统框架痛点,在多方面验证了其高性能。

机器之心