「多模型推理」共找到 10138 篇相关文章

开源动态8

标准化3D生成质量榜单来了!首创层次化评价体系,告别“谁的demo更吸睛”主观评估

Hi3DEval团队推出面向3D内容生成的全新层次化自动评测体系Hi3DEval,设计对象级、部件级与材质主题三层评测协议,在HuggingFace发布首期3D生成榜单,涵盖30个主流与前沿模型。

量子位
开源动态8

RAG终极框架!港大开源RAG-Anything:统一多模态知识图谱

香港大学黄超教授团队发布开源项目RAG - Anything,构建统一多模态知识图谱架构,解决传统RAG技术局限。它能处理多类型异构内容,提供端到端方案,有多种优势及应用模式,还给出部署指南和未来展望。

新智元
新闻资讯7

OpenAI算力账单曝光:70亿美元支出,大部分钱花在了“看不见的实验”

据Epoch AI统计,去年OpenAI计算资源支出70亿美元,多以租微软云算力支付。其中50亿研发算力,大多用于幕后研究和实验,非爆款模型的最终训练,也解释了其2024年亏损原因。

量子位
新闻资讯7

The Batch: 866|GPT-5 起飞遇乱流

OpenAI推出GPT - 5及其系列模型,涵盖多种类型,有新功能与性能提升。但发布中路由器故障等问题让用户失望。它在部分基准测试表现佳,不过抽象推理能力有不足,还回顾了发布历程。

DeeplearningAI
算法论文8

开放世界任务成功率82%!美的攻克机器人泛化控制难题

美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。

量子位
新闻资讯8

VLA爆发!从美国RT-2到中国FiS-VLA,机器人「即知即行」的终极进化

2025年具身智能爆火,VLA模型成核心。从美国RT - 2到中国FiS - VLA,VLA硬核进化。谷歌、微软等有重要成果,中国智平方等企业也不断创新,FiS - VLA性能超现有方法,VLA正重塑机器人与人类交互未来。

新智元
算法论文8

基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结

近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。

深度学习自然语言处理
算法论文8

首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒

新加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决核心难题,实验性能超基线,为多领域应用提供落地基座。

量子位
算法论文8

华为超树HTP:不写示例、不调PDDL,AI规划约束通过率飙升62.6%

文章介绍华为超树HTP,它是完全自主、可泛化的推理新范式。能让LLM在超树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确率并降低token成本,还阐述其原理、创新点及应用实例。

CourseAI
新闻资讯8

凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了

4月29日凌晨,OpenAI与亚马逊云科技联合发布多个新动态,如OpenAI旗舰模型进Bedrock预览、Amazon Bedrock Managed Agents预览等。双方合作让Agent有持久化记忆,还推出多项产品,亚马逊云科技成MaaS一极。

InfoQ