推理速度」共找到 2525 篇相关文章

开源动态8

从服务器 OS 到 Agent 沙箱:腾讯云如何打通 AI Infra 的生态底座

文章指出代码生成快但执行边界缺可靠设施,腾讯云开源 Cube Sandbox 项目。它基于 MicroVM 路线,突破隔离、速度、密度等门槛,v0.2.0 版本降低部署门槛。与 OpenCloudOS 9 组合,提供全链路开源可控路径。

InfoQ
新闻资讯8

哈佛《Science》研究:大模型已碾压人类医生!

哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。

AIGC开放社区
推荐文章8

大佬深度解析:Coding Agent的底层运行逻辑是什么?

本文由AI领域知名学者Sebastian Raschka撰写,探讨编码智能体及其编排的设计、工作原理和组件协同。指出智能体周边支撑系统重要性不亚于模型本身,详细阐述编码智能体六大核心构建模块。

机器之心
推荐文章8

没有KPI,也能领先OpenAI?从“内部观察者”视角看顶级AI实验室如何运作

InfoQ采访《哈萨比斯:谷歌AI之脑》作者塞巴斯蒂安·马拉比,从“内部观察者”视角解析DeepMind成长逻辑,探讨其与OpenAI、Anthropic差异,还谈及AI竞争格局、组织模式及资源配置等问题。

AI前线
7

记录下SGLang开发,优化,debug的技巧之大SKILL时代已来临

文章记录SGLang开发等技巧,介绍Agent在编程开发领域的强大能力,如完成多种工作、提升模型速度。还提及Agent流程优化方向,提醒警惕其偏差,指出人的价值转变,成为设计、把关和提炼者。

GiantPandaLLM
推荐文章8

英伟达GPU全系列硬核科普手册:一文读懂NVIDIA芯片的定位、规格与应用场景

这是英伟达GPU全系列硬核科普手册,覆盖消费级、工作站、推理卡、训练卡及中国特供版五大产品线,讲清区别与用法,还介绍架构演进、命名规则等,助读者秒变选型高手。

腾讯技术工程
新闻资讯8

OpenAI推出GPT-5.4 mini/nano;MiniMax发布M2.7;小米发布MiMo-V2系列模型

OpenAI、MiniMax、小米陆续发布新模型。OpenAI推GPT - 5.4 mini与nano,优化速度和成本;MiniMax的M2.7能自我演化;小米MiMo - V2系列覆盖智能体核心、全模态理解和情感语音合成。

AIGC开放社区
新闻资讯7

The Batch:926|AI 数据中心“脱离电网”

Meta和OpenAI等科技公司正建私有发电厂,为AI数据中心供电,绕过电网监管。项目推进快,有的用非传统发电设备。此举反映AI算力扩张超能源供应速度,有稳定电价作用,但也带来排放问题。

DeeplearningAI
算法论文8

Kimi新架构让马斯克叹服!17岁高中生作者一战成名

17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。

量子位
新闻资讯8

GPT-5.4发布:OpenAI首个大一统模型,简直是龙虾原生

OpenAI发布GPT - 5.4,这是其首个大一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。

量子位