测试时路由框架」共找到 3174 篇相关文章

算法论文8

让机器人「不仅会想,还能准确去做」,VLA-R1把「推理+行动」带进真实世界

VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它有两阶段训练、三类可验证奖励等创新点,经多层面测试效果好,在多领域有应用前景。

机器之心
开源动态8

Embodied Arena:业界首个统一具身大脑评测平台重磅发布,30+模型全面对比揭示关键洞察

具身智能火热,研究者常感茫然。Embodied Arena评测平台上线,它全面统一且持续演进,涵盖22+基准测试和30+模型,构建评估体系,揭示关键洞察,为具身模型发展指引方向。

AI科技评论
算法论文8

EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式

本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。

深度学习自然语言处理
算法论文8

ACL'25 | 多智能体叛变进行中?首个多智能体安全守卫G-Safeguard亮相!

随着基于LLM的多智能体系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于图神经网络,通过构建多智能体话语图等方式,能有效抑制恶意信息传播,有强大防御和泛化能力。

PaperAgent
开源动态8

说句话,造个3D世界!腾讯VibeWorlding氛围造世界

香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。

AIGC开放社区
算法论文8

GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026

本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在多基准任务上超越基线算法。

AI科技评论
新闻资讯7

实锤!GPT-5.5「降智」被抓,OpenAI官方文档认了

近期,网友发现GPT - 5.5使用一两个小时后突然变傻、质量下降,开发者经测试实锤系统会静默切换模型。Plus和Pro用户均受影响,此前GPT各版本升级也常引发“降智争议”。

新智元
新闻资讯8

推进科研和工程,编程跻身顶级人类竞赛榜:谷歌Gemini 3 Deep Think重大升级

谷歌发布Gemini 3 Deep Think重大更新,剑指科研和工程。它在编程算法竞赛等多项测试中成绩亮眼,能模拟人类科学家深度思考,处理复杂问题,还可重塑工程设计流程,已向部分用户和企业开放。

AIGC开放社区
开源动态8

开源白嫖!微软这个开源 Agent,让 AI 帮你点按钮、填表格、跑多步流程(还可跨设备)

微软开源智能自动化框架 UFO,主线是 UFO³(Galaxy 多设备编排)+ UFO²(Windows 桌面 AgentOS)。能将多步任务拆分执行,解决跨应用、多步骤甚至跨设备任务难题,有多种功能亮点。

小华同学ai
产品应用8

阿里发了个简历AI神器,大小仅0.6B

阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖大模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。

量子位