PhyT2V框架」共找到 3373 篇相关文章

算法论文8

二元成功率已经过时!PRM-as-a-Judge才是你需要的具身操作评测框架

传统二元成功率评测具身操作任务有局限,难回答策略推进、执行效率等问题。中科院自动化所等机构研究人员提出PRM - as - Judge框架,含进度势能、OPD指标体系和RoboPulse基准,能细粒度审计执行过程。

机器之心
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型能力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋能国内 AI 生态圈。

特工宇宙
产品应用8

GPT-5.2技术炸场!6大核心突破,办公效率拉满

OpenAI凌晨发布GPT-5.2,把专业级AI门槛拉到新高度。它有6大核心技术突破,精准戳中职场痛点。在GDPval基准测试中表现出色,有三级模型矩阵,不同版本满足不同需求,各方面能力均有显著提升。

CourseAI
新闻资讯7

DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了

DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。

机器之心
开源动态8

兼顾效率、成本与能力,百灵开源旗舰推理模型 Ring-2.6-1T

5月15日,蚂蚁百灵开源旗舰级推理模型Ring-2.6-1T,权重文件上线Hugging Face、ModelScope平台。该模型有万亿参数,‘按需思考’,在代理执行、推理机制、训练范式三方面升级,评测表现出色。

AI前线
算法论文8

T2R-Bench发布:业内首个由表格生成报告工业基准

为解决大语言模型将表格信息转化为报告的难题,研究团队提出“表格到报告”任务,构建双语基准T2R - bench,其涵盖多垂域表格,还设计评价指标体系,实验显示大模型在该基准上提升空间大。

CourseAI
算法论文8

让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了

近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。

机器之心
产品应用7

AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战

2025 年 GUI Agent 赛道升温,多数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具多能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。

特工宇宙
开源动态7

MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents

MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。

GitHubStore
开源动态7

龙虾再进化!强化飞书表格技能,25.2万星登顶超越React/Linux

OpenClaw 2026.3.1正式发布,合并九十多个PR。其Star飙升至25.2万颗,超Meta的React登顶GitHub。更新核心卖点有二:模型武装升级,安卓节点玩法扩容;对国内使用更友好,可在飞书文档操作,Web UI支持双语。

量子位