「测试技术」共找到 4402 篇相关文章
专治Demo玩家:「具身灵巧操作奥林匹克」大赛三项第一,全被国内这家公司拿下
星动纪元凭借自研VLA具身智能模型,在具身界灵巧操作奥林匹克Benjie's Olympics大赛中,于翻袜子(银牌难度)、开锁和剥橘子(金牌难度)三项任务上击败技术领先者PI,拿下全球第一,展现全栈技术优势。
从“暴力烧Token”到“系统工程”:OpenAI与华为的两条 AI 编程路径
文章对比OpenAI与华为的AI编程路径,指出模型中心派靠推高上下文窗口但有成本高、延迟大等问题;工具驱动派如Cursor和华为云码道重构IDE工具。码道将任务解耦,通过多技术实现性价比,还介绍了底层基石及其实测表现。
上海 AI Lab 庞江淼:开放平台是具身智能“ChatGPT 时刻”的前提|具身先锋十人谈
上海AI Lab庞江淼认为开放平台是具身智能“ChatGPT时刻”的前提。他早期专注CV,后转型切入底层控制。他指出具身智能Scaling Law非简单线性,还探讨了大小脑融合、VLA技术等,团队发布的Intern - Robotics目标是建开放基础设施。
腾讯出手了!彻底入局Agent
腾讯云入局智能体赛道,将大模型知识引擎升级为智能体开发平台。该平台亮点多,如可一键发布到企业微信,具备多工具调用、多Agent协作能力,工作流有全局视野Agent节点,还有Excel检索增强功能,经测试表现出色。
普林斯顿团队领衔发布最强开源数学定理证明模型:32B性能大幅超越前代SOTA DeepSeek 671B
近日,普林斯顿大学牵头多机构推出开源数学定理证明模型 Goedel-Prover-V2。其 32B 旗舰模型在多基准测试超 DeepSeek-Prover-V2-671B,8B 小模型特定基准性能与之持平。该模型有三项关键创新,团队已公开模型及数据集。
从「降本增效」到「智能中枢」:低代码在 AI 浪潮中的价值重估——专访金现代赵鹏程谈企业数字化转型新引擎
LowCode低码时代专访金现代轻骑兵低代码PaaS平台产品经理赵鹏程,探讨AI与低代码融合对软件工程范式革新和企业数字化转型的影响。介绍了低代码价值重估、应对新兴技术、企业实践、跨越工程化鸿沟路径、核心竞争力及未来展望等内容。
Agent 工程师绕不开的必修课:API 网关 vs API 管理
文章探讨了 API 网关与 API 管理的起源发展、关键差异、协同工作及未来趋势。API 网关从流量网关演进到 AI 网关,API 管理从文档化走向商业化。两者差异源于起点、使用角色和技术内核不同,未来将向 AI 网关和 MCP Server 管理演进。
扒开源码:那个宣称“每半小时疯抢1万个注册码”的AI项目,到底在割谁?
近期技术群流传 UUMit 平台链接,宣称是“能让 AI 智能体自己接单打工赚钱的 A2A 平台”,极为火爆。但作者查看源码发现,该平台是前端单机戏法、点击劫持的广告套利站。文中还介绍了 AI 概念下五种套利黑产及识别方法。
都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了
当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。
原力灵机发布Realtime-VLA V2:从遥操作到真实部署,VLA提速的系统解法
原力灵机发布《Realtime - VLA V2》技术报告,在VLA控制下让机器人快速运动。实现数倍于遥操作采集训练数据的速度执行VLA,解决了遥操作数据采集、时序延迟等问题,还通过“油门式采集”提升速度,但离人类性能仍有差距。