基准构建」共找到 2657 篇相关文章

产品应用8

VLA进化后降维打击!双手拣货,漂移操作,还能批量化秀舞,太空舱直接开上街,被银河通用卷到了

世界机器人大会上,银河通用的人形机器人Galbot在具身智能小卖部营业,背后是自研端到端具身智能大模型。其与英伟达联合首发的机器人应用表现出色,太空舱也在北京首发,适配多场景,具身大模型商用能力获认可。

量子位
新闻资讯7

安全噩梦:Docker 警告 MCP 工具链中存在的风险

Docker 博文警告,基于 MCP 构建的 AI 开发工具引入安全漏洞,如凭证泄露等。MCP 发展迅猛但部分实现有隐患,Docker 分析发现广泛漏洞,还提出强化方法应对风险,其他厂商也有类似担忧。

AI前线
算法论文8

推理路径的动态调控:让大模型学会“恰到好处”的思考

当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
算法论文8

ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路

前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。

深度学习自然语言处理
算法论文8

半量工具,双倍效能:ARPO革新大模型强化学习

大语言模型在多轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升多轮推理性能。

深度学习自然语言处理
推荐文章8

从WAIC上爆火的功夫机器人,看到这家央企的具身智能「真功夫」

今年4月“功夫boy”机器人出圈,3个月后的WAIC上它全新升级。其背后是中国电信人工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,在硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。

机器之心
算法论文8

EAAI | 香港理工大学王旭等:一种增强MFNN的多源气动数据重构方法

飞行器气动压力分布获取依赖风洞试验或数值模拟,多源数据差异为气动数据重构带来挑战。本研究提出增强型多保真神经网络,通过差分运算提升模型泛化精度,在跨声速压力分布重构中效果显著。

力学与人工智能
开源动态8

微软开源2025 ICML获奖框架,终结大模型多轮对话严重缺陷

微软开源2025年ICML获奖框架CoLLabLLM,可解决大模型多轮对话缺陷。它由四大模块构成,经多轮对话模拟和奖励优化模型。在三大基准平台测试显示,能在多样任务中高效协作。

AIGC开放社区
算法论文8

揭示隐藏联系:RLHF/DPO即对比学习!

大型语言模型输出符合人类价值观是挑战,主流技术RLHF复杂、昂贵且不稳定,DPO简化流程但有训练崩溃问题。论文揭示RLHF/DPO即对比学习,提出MIO算法解决DPO崩溃,实验验证其性能优势。

深度学习自然语言处理
新闻资讯7

华为系EDA,落子上海!

华为哈勃投资的九同方从武汉迁至上海,其作为专注IC设计服务的EDA公司,熬过十年冷板凳,产品达国际领先。华为借此建立自主工具链,九同方可对接长三角资源,当下国产EDA企业受关注且并购频发。

芯师爷