通用框架」共找到 2275 篇相关文章

算法论文8

二元成功率已经过时!PRM-as-a-Judge才是你需要的具身操作评测框架

传统二元成功率评测具身操作任务有局限,难回答策略推进、执行效率等问题。中科院自动化所等机构研究人员提出PRM - as - Judge框架,含进度势能、OPD指标体系和RoboPulse基准,能细粒度审计执行过程。

机器之心
新闻资讯8

产业级 Agent 如何破局?百度吴健民:通用模型难“通吃”,垂直场景才是出路

InfoQ 采访百度吴健民探讨产业级 Agent 破局点。他指出 Agentic 模型训练卡点在真实环境复刻;通用模型难“通吃”,垂直场景定制模型是关键;多模态未实现统一建模,分开优化效果更好。

AI前线
算法论文8

让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了

近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。

机器之心
开源动态8

超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law

近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。

机器之心
开源动态7

MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents

MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。

GitHubStore
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
产品应用8

全球首个多模态矢量动画生成框架,轻松拿捏跨平台轻量动画

复旦大学等团队推出OmniLottie框架,利用创新分词技术将视频、图文指令变成高质量矢量动画。团队还打造数据集MMLottie - 2M,构建测试基准MMLottie - Bench。实验显示,OmniLottie在多任务测试中优势明显。

AIGC开放社区
算法论文8

效果、性能双突破,快手OneSug端到端生成式框架入选AAAI 2026

查询推荐是电商搜索关键功能,传统方法有局限。快手提出OneSug端到端生成式框架,统一多阶段,提升效果与效率,成果入选AAAI 2026,已在快手电商全量推广,显著提升多项指标。

机器之心
开源动态8

当世界模型不止「视频」该如何评估?WorldLens提出实用化评估新框架

生成式世界模型在多领域进展显著,但评估存在局限。WorldBench 团队构建 WorldLens 评测框架,从五个维度评测开源世界模型,其评测 EvalKit 已公开,可暴露模型能力边界与失效模式。

机器之心
新闻资讯7

独家 | 开普勒联合创始人胡德波成立「索塔无界」,聚焦通用基座模型+海外市场

AI科技评论独家消息,开普勒机器人联合创始人胡德波2026年4月成立索塔无界。该公司聚焦通用基座模型,以统一潜空间世界动作模型为核心,提出物理智能大脑技术路线,已与欧美企业达成合作意向。

AI科技评论