测试技术」共找到 4397 篇相关文章

开源动态7

SGLang × RoleBasedGroup(RBG):打通大模型推理PD分离架构规模化落地的“最后一公里”

PD分离架构对大模型推理部署意义重大,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。

InfoQ
推荐文章8

Shopify 经验贴:如何搞出一个生产级别可用的 AI Agent 系统?

Shopify 以 AI 助手 Sidekick 为例,分享从简单工具调用系统演变为复杂 AI Agent 平台的经验,包括架构设计、评估方法和训练技术等方面,还给出构建生产级别可用的 AI Agent 系统的四条核心建议。

Founder Park
新闻资讯7

「纳米香蕉」LMArena两周500万投票,引爆10倍流量!谷歌、OpenAI扎堆打擂台

8月,「纳米香蕉」登顶LMArena文生图像榜单,带动社区流量暴增10倍,月活超300万。其盲测两周吸引超500万次投票。LMArena前身是Chatbot Arena,为大模型提供比拼舞台,厂商借此获曝光和反馈。

新智元
新闻资讯7

当AI比我们更聪明:李飞飞和Hinton给出截然相反的生存指南

如今AI发展火热,人类对其安全担忧已久。李飞飞和Hinton在Ai4 2025上给出相反答案,前者认为AI会成人类伙伴,安全性靠设计等;后者觉得超级智能或难控制,要造‘关心人类’的AI。还探讨了AI行为两种解读。

机器之心
算法论文8

追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%

中兴通讯和中国移动团队针对电信网络故障诊断难题,提出 TN - RCA530 基准和 Auto - RCA 框架。测试多个大模型,初始准确率低,经框架优化后,Gemini - 2.5 - Pro 准确率从 58.99% 升至 91.79%,超人工水平。

机器之心
产品应用8

让64张卡像一张卡!浪潮信息发布新一代AI超节点,支持四大国产开源模型同时运行

浪潮信息发布新一代AI超节点“元脑SD200”,可让64张卡像一张卡。它支持四大国产开源模型同时运行,实现算力聚合突破,通过软硬协同优化提升推理性能,采用开放架构推动“智能平权”。

量子位
推荐文章7

从 MCP 到 Agent:构建可扩展的 AI 开发生态的工程实践

本文整理自字节跳动 Trae 架构师陈仲寅在 AICon 2025 上海的分享。探讨通过 MCP 及 Agent 构建可扩展生态体系,涵盖自定义 Agent 设计、与工具集成及共建等内容,还展望技术演进方向与 AICon 深圳站信息。

AI前线
新闻资讯8

剑指“美国版 DeepSeek!”Ai2 科学家 Nathan Lambert 最新访谈:剖析 RLVR、激辩智能体与后训练

艾伦人工智能研究所科学家 Nathan Lambert 在访谈中剖析 RLVR、激辩智能体与后训练。他所在团队用 Olmo 和 Tulu 模型揭开后训练魔法,带火 RLVR 概念。他还谈到开源 AI 未来,想打造“美国版 DeepSeek”。

AI科技大本营
新闻资讯8

“连我也要被GPT-5踹了!”Altman再发暴论:写款软件就花7毛钱,大批高级程序员岗也说没就没

OpenAI 首席执行官 Sam Altman 在播客和会议上谈 GPT - 5,称其“几乎所有方面比人类聪明”,还预言 AI 对就业、医疗等领域影响大,也指出 AI 有欺诈等风险,强调其发展不确定性。

InfoQ
推荐文章7

在 AI 时代构建 MVP

文章围绕AI在构建最小可行产品(MVP)中的作用展开。它能在理解QARs、推动架构决策等多方面提供帮助,如提出被忽略的需求、缩小技术搜索范围等,但不能完全替代人类做决策。

InfoQ