「多领域推理」共找到 6403 篇相关文章
Base44 也 1 亿美金 ARR 了,又一华人语音 AI 一年实现 1000 万美金 ARR
AI 领域发展迅速,Base44 成立 1 年突破 1 亿美金 ARR,AI Coding 是增长快的细分领域,Cursor 进入以 Cloud Agents 为核心的新阶段,还介绍了其带来的新变化,AI 语音 Infra 也有亮眼成绩。
谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”
谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。
类R1训练不再只看结果对错!港中文推出SophiaVL-R1模型
DeepSeek - R1爆火后,类R1结果奖励训练范式引发推理热潮,但仅以结果对错奖励模型有弊端。港中文联合团队发布多模态推理模型SophiaVL - R1,引入‘思考奖励’机制,还用Trust - GRPO算法解决奖励欺骗问题。
入局AI Infra:程序员必须了解的AI系统设计与挑战知识
文章分享传统后台工程师技术栈和方法论如何迁移到AI系统,系统性拆解AI Infra的硬件、软件、训练和推理挑战,如硬件从CPU到GPU、软件依赖深度学习框架,还分析训练和推理面临的问题及解决办法。
当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team
本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代,多 Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把多 Agent 协作推进到‘管理驱动’,其价值在于将隐性约束显性化。
中学生就能看懂:从零开始理解LLM内部原理【十三】|GPT 架构如何工作 ?
本文是对GPT架构工作原理的解读。介绍了GPT与Transformer的关系,阐述其从输入文本到预测下一词概率的流水线,详述训练和推理流程,还提及GPT架构进化的混合专家(MoE)模型。
「AI大模型时代的CIO」云栖专场: AI实战者与落地破局者的坦白局
云栖大会「AI大模型时代的CIO」专场,探讨企业AI落地难题。虽搭上AI电梯是趋势,但企业落地有不确定性,如组织架构不匹配等。多位实战者分享经验,给出RIDE等解法,助企业破局。
腾讯「鹅虾」紧急上线!一手实测:养虾门槛归零,QQ飞书钉钉全能接
腾讯昨日上线两个「鹅虾」产品,WorkBuddy是能接入多平台的智能体桌面平台,QClaw预计下周公测,可接入微信。作者实测WorkBuddy,考察其生态接入、代码开发等场景表现,还介绍了QClaw特点及腾讯云轻量应用服务器。
阿里开源 Team 版 OpenClaw,5分钟完成本地安装
阿里开源 Team 版 OpenClaw——HiClaw,它是 OpenClaw 超进化版,引入 Manager Agent 角色,解决了 OpenClaw 在安全、多任务协作、移动端体验、记忆管理等方面的痛点,还集成多个开源组件,部署简单,适合开发者和企业。
一个能思考、会记忆的AI导演诞生了!新加坡管理大学,香港中文大学等实现故事化视频生成
新加坡管理大学等提出开源全能多智能体框架UniVA,可统一视频理解、分割等能力,按指令生成完整故事视频。还引入UniVA - Bench基准测试套件,实验显示其在多任务中表现出色,代表视频智能生成重要进步。