多LLM系统」共找到 5956 篇相关文章

开源动态8

DeepSeek倒逼vLLM升级!芯片内卷、MoE横扫千模,vLLM核心维护者独家回应:如何凭PyTorch坐稳推理“铁王座”

本文介绍了vLLM的发展,自开源后成科技公司首选推理引擎。因DeepSeek发布,团队转向其模型特性优化;还参与各芯片支持工作。vLLM靠PyTorch支持硬件,同时拓展到模态推理,面临竞争仍保持优势。

InfoQ
算法论文7

4D空间智能:AI如何一步步「看懂」时空结构?一篇综述解析通往四维世界的五大层次

4D空间智能重建整合静态场景与时空变化,构建含时间维度的空间表征系统。南洋理工等高校研究者调研该领域,提出按建构深度分五层的新视角,展现AI认知从基础到高阶的进化路径。

机器之心
产品应用8

抢先OpenAI?AIUI全新升级燃爆22亿终端,国内大厂定义智能交互

科大讯飞围绕智能交互场景,对AIUI、机器人超脑等4大平台全面升级。其AIUI以大模型为引擎,有儿童专属交互方案,还推出智能眼镜“三麦阵列”等,各平台在领域应用成果显著。

新智元
新闻资讯7

曦望,死磕AI推理成本|甲子光年

1月27日,国产GPU厂商曦望发布新一代推理GPU芯片启望S3等。启望S3面向大模型推理定制,设计系统级重构,单位Token推理成本降约90%。曦望还推出超节点方案及推理云计划,目标是极致推理性价比。

甲子光年
产品应用8

告别碎片化日志:一套方案采集所有主流 AI 编程工具

在AI编程工具普及的当下,有效采集和分析AI代码生成数据成重要课题。该文介绍一套基于MCP架构的AI工具代码采集方案,支持种工具和操作系统,有轻量化、用户无感等特点,已和Aone合作。

阿里云开发者
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。

机器之心
推荐文章8

DevOps之父:发几个Claude Code账号就叫AI转型?Agent用不好是公司的锅

DevOps 之父 Patrick Debois 认为,企业 AI 转型不能仅停留在给开发者买工具,Agent 效果不佳,问题或在公司。开发者要转变思维,改进产出代码的系统,组织要围绕 Agent 重构协作方式。

InfoQ
新闻资讯7

宇树背后的供应链赌局:不怕错,怕空|甲子光年

文章介绍新能安,作为宁德时代和新能源科技合资子公司,在领域成龙头。它凭借技术积累切入人形机器人电池赛道,给宇树供货,试图建立标准,虽赛道有泡沫和风险,但提前布局或占先机。

甲子光年
开源动态8

企业级OpenClaw最强拍档来了!万亿参数的国产模态大模型,刚刚开源发布

YuanLab.ai团队开源源Yuan3.0 Ultra模态基础大模型,是万亿级开源模态大模型之一。它优化训练效率,在任务表现突出,为企业Agent AI提供支撑,还提出新算法和训练策略,全面开源推动落地。

量子位
开源动态8

阶跃新模型快到“没推理”!印奇上任,果然气势一新

印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配家芯片厂商,在场景表现出色,还具备端云协同能力,架构也有项优化。

量子位