多步聚合训练」共找到 5695 篇相关文章

开源动态8

LeRobot v0.4.0 正式发布:全面提升开源机器人的学习能力

LeRobot v0.4.0 正式发布,带来方面重大升级。有可扩展的 Datasets v3.0、新 VLA 模型、全新插件系统;支持 LIBERO 和 Meta - World 仿真;还有数据处理 Pipeline、 GPU 训练简化等特性,上线了机器人学习课程。

Hugging Face
开源动态8

让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO

腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
产品应用7

AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战

2025 年 GUI Agent 赛道升温,数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。

特工宇宙
算法论文7

AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在任务表现良好。

量子位
新闻资讯7

创新中心深度支持:20支队伍、300位观众、7小时PK,国内首档AI竞技综艺收官

5月10日,国内首档AI竞技综艺“AI极客争霸赛·奇点市·脑洞嘉年华”在北京收官。20支参赛团队覆盖AI垂直领域,带来各具特色的脑洞项目,最终《狗眼看世界吧》获冠军。活动由北京AIGC视听产业创新中心等支持。

郎园Station
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
新闻资讯7

GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够

OpenAI 发布 GPT - 5 进军企业市场,虽发布不顺利,但部分初创公司和企业客户反馈其在复杂任务表现出色、价格低廉。OpenAI 联创 Greg Brockman 揭秘 GPT - 5,称其代表‘几乎难以形容的智能’,是科研好伙伴,还探讨算力、模型训练等问题。

InfoQ
算法论文8

AI Agents和Agentic AI有什么区别?

论文《AI Agents vs. Agentic AI》深入探讨AI Agent和Agentic AI的本质差异。AI Agents是集成大模型和外部工具的单体系统,适合简单任务;Agentic AI是智能体协作新范式,适合复杂场景。还提及挑战、解决方案与未来方向。

AGI Hunt
产品应用7

14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相

斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户可教它新本领,预计2026年推出。

量子位
算法论文8

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。

机器之心