动作验证器」共找到 1286 篇相关文章

开源动态8

DeepSeek Harness背后的“心脏”:Cordis 到底是什么

文章介绍Cordis框架,它原服务第三方QQ机人,现是DeepSeek Harness心脏。阐述其设计初衷、核心机制,如插件、上下文等概念,还提及在DSH中的应用,展示了插件槽位和生态,最后介绍相关论文和该框架的生态情况。

腾讯技术工程
算法论文8

GCEA-YOLO:给油田装上"防火眼",把抽烟行为检测精度拉高 20.8%

油田抽烟事故损失大,传统检测方法有局限,深度学习模型也面临难题。作者基于YOLOv11n构建GCEA - YOLO网络,含ADown、CSP - EDLAN、GFPN、EfficientHead四个模块,检测精度显著提升,还验证了泛化与稳定性,并给出复现代码。

机器学习AI算法工程
开源动态8

人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代

2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。

机器之心
算法论文7

AMS| 西工大史子颉,高传强,王旭,林海涛,张伟伟:数据驱动的涡激振动标度律发现

涡激振动最大振幅是评估结构安全的关键指标,现有理论模型有局限,常用数据驱动方法也面临挑战。本文提出两次应用符号回归的“白箱”标度参数VIV建模方法,验证了其鲁棒性与泛化能力,还给出物理层面解释。

力学与人工智能
产品应用8

一个月的活一周干完!英伟达世界模型训练速度飙升400%

英伟达世界动作模型 DreamZero 训练成本高、耗时长,无问芯穹与清华等推出的 RLinf 框架,从算子融合到 I/O 全链路系统级重构,使训练吞吐拉高近 4 倍,还解决多类性能瓶颈,保证训练效果。

新智元
产品应用8

狗翻了个身,国产GPU往前走了坚实一步|甲子光年

5月18日摩尔线程发布会上,机狗“小飞”侧空翻,是业内首次基于国产硬件仿真平台训练、国产端侧芯片部署并真机验证。该司以全功能GPU打造国产具身智能基础设施,MT Lambda平台解决多方面问题。

甲子光年
算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
新闻资讯7

人形机人绕不开的坎:续航问题怎么破?

人形机人续航问题常被忽视,但它面临电池重量、行走能耗、脉冲负荷三个维度约束,标称续航在实际工况会打折,工程上可通过快速换电和提升单次充电电量应对,固态电池有潜力但有待验证

DeepTech深科技
新闻资讯7

人形机人规模化前夜,硬件供应链是真正的深水区

过去三年,人形机人行业投资火热,但供应链瓶颈成商业化关键制约。麦肯锡报告分析成本结构,指出执行是成本大头且供应体系不成熟。全球供应风险分三档,中国供应链有优势,2035年格局或转变。

DeepTech深科技
推荐文章8

突破泛化瓶颈:阿里云智能运维 Agent 评测体系实践

大模型 Agent 在智能运维场景落地常遇泛化难题。阿里云李也博士介绍利用评测集验证和提升智能运维算法泛化性的实践,阐述评测集重要性、构建方法,还展示其在提升智能运维 Agent 能力上的成效。

InfoQ