验证场景」共找到 2662 篇相关文章

算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
新闻资讯7

人形机器人绕不开的坎:续航问题怎么破?

人形机器人续航问题常被忽视,但它面临电池重量、行走能耗、脉冲负荷三个维度约束,标称续航在实际工况会打折,工程上可通过快速换电和提升单次充电电量应对,固态电池有潜力但有待验证

DeepTech深科技
产品应用8

TRAE SOLO 移动端发布!超级 Agent 终于走出了桌面

TRAE SOLO 移动端正式上线,同时 Windows 版本也同步发布,实现手机、PC、Web 三端全量开放且无需邀请码。它能完成多种任务,三端任务信息实时全量同步,设备配对简单,在生产力场景实测效果出色。

特工宇宙
开源动态8

智谱首秀工程实战经验!Coding Agent日均数亿次调用,GLM-5把长上下文推理的底层问题全逼出来了

今年 2 月智谱 GLM Coding Plan 上线后很受欢迎,随着用户和调用量上涨,Coding Agent 成压力测试场。4 月 30 日智谱发布博客,披露 GLM - 5 系列模型在超大规模 Coding Agent 调用场景下的底层推理技术突破及工程实践经验。

InfoQ
推荐文章8

《动手写AI Agent》前言 · 先看完成品

作者因想搞懂 Agent 原理,且市面上缺系统学习资料,决定手写一份教程,即《动手写 AI Agent》。书中 Ling 是从零手写的编程助手,介绍了其 8 个应用场景、技术规格,还说明了适合读者与全书路线图。

AI Reading Hub
产品应用8

对话贝陪科技:好的 AI 陪伴产品,应该让 AI 少说话

贝陪科技创始人黄缨宁分享打造儿童AI陪伴产品「可豆陪陪」的经验。产品让AI少说话,激发孩子表达欲,上线150天后留存率达51%。黄缨宁认为AI陪伴要营造成长环境,还介绍产品定位、使用场景、设计思路等。

Founder Park
新闻资讯8

2026年具身智能进入“上市大年”

2026年开年不到三月,具身智能赛道涌入200亿热钱,7家企业成百亿估值独角兽,超20家明确上市计划。虽2025年该领域有泡沫成共识,但因政策加持、技术突破等因素,投资机构仍重金下注。行业格局分六大派系。

芯师爷
产品应用8

接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了

作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。

特工宇宙
开源动态8

工业级 LLM 数据工程:北京大学 DCAI 团队 DataFlow 框架的架构设计与实践

2026 年大模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度成突破关键。北京大学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其能提升模型性能。

InfoQ
新闻资讯8

20亿砸向00后创业机器人公司!估值一年暴涨7倍,国家级资本重仓

近日,灵初智能完成约20亿元天使轮及Pre - A轮融资,资金将用于物流场景落地与数据采集体系建设。其团队互补,突围逻辑是All in人类原生数据,自研采集方案,走“模型驱动数据”路径,定位“大脑驱动公司”。

量子位