超低延迟」共找到 3036 篇相关文章

产品应用7

从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式的转移

作者分享了从单 Agent 协作到多 Agent 协作的编程范式转变。当前主流 AI 开发多为单 Agent 协作,效率,作者设计了 Mexus 工具,解决多 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。

阿里云开发者
产品应用8

Claude Code 2.1 发布:一口气更新了80多个功能特性

2026年1月7日Claude Code发布2.1.0版本,后又跟了2.1.1小修复,更新内容80条。有Skills自动热重载等新功能、大量bug修复及体验优化。作者建议大家升级,认为它想做完整开发环境。

花叔
新闻资讯7

上海机器人独角兽,IPO终止!

近日,节卡机器人科创板IPO审核动态变为“终止”。该公司2014年创立于上海,累计融资14亿。此前问询环节,监管关注核心技术等问题。近年营收增长,净利润有波动,2025上半年亏损。行业成长空间大,其未来走向待察。

芯师爷
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
开源动态7

强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果越GPT!

科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或SOTA性能。

量子位
开源动态8

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。后者在AIME25测评得分Claude 4 Opus,两模型能力较前作均有提升。

量子位
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
开源动态8

本地Opus你要不要!Qwen3.8-27B开源

阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent、多模态跑分表现出色。

AIGC开放社区
产品应用8

英伟达帮你省钱,让大模型推理「短而精」,速度快5倍

过去大模型推理追求长链思维,导致推理链长、Token消耗大、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减70%且准确率不变,还适用于大模型。

机器之心
产品应用7

通过逆向工程探秘 Claude Code 背后的运作机制

作者通过逆向工程研究Claude Code内部运作,了解其比Cursor等工具慢且贵的原因。Claude Code注重通用性和安全性,执行任务时多有安全检查,虽增加成本延迟,但更可靠,且在命令行工具中用户体验出色。

宝玉AI