多步聚合训练」共找到 5661 篇相关文章

新闻资讯8

「只参与,不参赛」奖牌数却仅次于宇树,这个幕后玩家如何做到的?

2025年世界人形机器人运动会,宇树科技获奖最,没参赛的加速进化T1获奖牌数排第三。这家新公司选不同发展路径,重产品与生态,技术应用于场景,有望成行业‘苹果’。

机器之心
产品应用8

Claude Code is All You Need

Anthropic内部把Claude Code当万能助手。它核心理念是“一切皆文件”,能管理文件、日志和待办事项,还可打通Apple生态。MCP让其获取更上下文。社区用户分享了在场景的使用体验和技巧。

AGI Hunt
开源动态8

中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026

北京邮电大学等机构联合提出新颖端到端框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。

AI前线
算法论文8

CVPR 2026|DROID-W:复杂室外动态场景,也能稳定SLAM

苏黎世联邦理工与微软团队提出 DROID - W 动态 SLAM 框架,即将发表于 CVPR 2026。它不预设动态物体,从视角观测识别不可靠区域,还提出交替优化方案,在个数据集表现优。

机器之心
产品应用8

只要1分钟!电脑装满血龙虾,现在跟下载APP似的

智谱推出电脑端应用AutoClaw(澳龙),从安装到使用仅需1分钟,无需配置。它可切换种模型,预置50个Skills。能一键接入飞书,玩法样,还降低了OpenClaw使用门槛。

量子位
算法论文8

当AI穿上白大褂:医疗智能体正在重构临床工作流

新加坡等所高校联合发表医疗智能体综述研究。医疗智能体有感知 - 认知 - 行动闭环,能深入临床长链条工作流。综述剖析其架构、协同机制、应用场景与安全挑战,还探讨评估及发展方向。

AIGC开放社区
算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化响应属性,团队还提出自适应难度变体,实验显示 GFPO 在方面表现出色。

机器之心
新闻资讯7

Meta出走华人创业团队,种子轮800万美元,要打造视觉AI记忆大脑

由前Meta顶尖科学家创立的Memories.ai获800万美元种子轮融资。其大视觉记忆模型LVMM解决AI‘记忆缺失’问题,在领域刷新SOTA基准,应用潜力大,还开放API及网页应用。

机器之心
新闻资讯7

SpaceX为何官宣收购xAI?8万亿太空炼丹梦,别无脑跟进!

2026 年 2 月 3 日,马斯克宣布 SpaceX 全资收购 xAI。直接原因是 SpaceX 盈利而 xAI 烧钱,合并为解决资金问题;根本原因是 Grok 竞争失利,想借 SpaceX 运载能力打造太空算力形成差异。但太空训练面临散热等难题,推理可行。

新智元
新闻资讯8

Generalist最新长文定调:具身原生才是正道,中国玩家原力灵机已交卷

Generalist创始人Pete Florence团队释出GEN-1技术博客,否定世界模型与VLA之争,强调具身智能应回归目标,主张从零训练。中国原力灵机DM0也采用具身原生路线,在RoboChallenge评测中成绩优异。

量子位