「计算架构」共找到 2375 篇相关文章
“老程序员”为啥不迷信 AI 带来的效率提升?聊聊 AI 编码的局限与现实
开发经验丰富的人对AI编码提升效率更保守,因现有开发模式下,AI编程效率提升有限。特定场景AI给力,但项目复杂时提升迅速下降,还分析了原因,最后提到微服务架构或在AI编程时代重新火起来。
沈亦晨的九年:从MIT一间实验室到港交所大堂
2026年4月28日,曦智科技在港交所敲钟,股价表现亮眼。创始人沈亦晨从MIT实验室起步,带领公司历经九年发展,在光计算和光互连领域取得诸多成果,虽亏损但受市场热捧,光计算产业也吸引大厂入局。
北大团队提出 SHINE:将任意文本转化为大模型 LoRA,仅需一次前向传播!
北大团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化为大模型 LoRA 参数,支持多轮对话。该方法实用潜力大、架构创新高效,训练流程成熟,推理快速,为大模型持续学习提供新思路。
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。
跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026
在量子位MEET2026智能未来大会上,蚂蚁集团赵俊博称扩散架构能直接修改控制token,理论上速度更快、成本更低。他团队押注扩散架构,近期开源千亿规模LLaDA 2.0。该领域虽处早期,但发展快,吸引众多巨头和初创公司布局。
奥特曼预告ChatGPT新产品!Pro会员也要额外收费,这次不计成本投入算力
OpenAI已花160亿美元租计算资源,还计划未来五年额外支出1000亿租备用服务器。2024 - 2030年将砸3500亿用于服务器租赁,2030年研发投入近收入50%。奥特曼预告未来几周有计算密集型新产品,部分对Pro用户额外收费。
基于大模型的领域场景开发:从单智能体到多智能体的React框架设计与实现
作者团队经历从提示词工程到流程编排模式各阶段,现设计架构升级,选用层级指挥模式的React框架,实现单智能体对工具调用的反思规划,后续还将迭代实现多智能体协作,同时提及技术选型、系统架构等内容。
蚂蚁·安诊儿医疗大模型:正式开源并登顶权威医疗榜单
近日,蚂蚁集团联合浙江省卫生健康委开源自研的蚂蚁·安诊儿医疗大模型。它基于蚂蚁百灵大模型架构,经深度训练,是参数规模最大的开源医疗模型。该模型在多评测中表现出色,有三阶段训练流程,架构高效、推理快,已开源助力行业发展。
牛芯基于UB协议,以IP筑牢生态根基
本文围绕牛芯半导体在UB协议生态中的IP布局展开。UB协议填补国内空白、打破国外垄断,牛芯的PHY IP等取得进展。还介绍其设计理念、架构优势等,如对等架构、单边语义等,以及在内存池、拥塞控制等方面的应用,助力开放算力生态。
重塑记忆架构:LLM正在安装「操作系统」
现代大型语言模型(LLM)存在「记忆缺陷」,难以维持长期记忆。近期关于大模型记忆的研究增多,如 MemOS 等。文中介绍了长上下文处理能力与记忆的关系、记忆类型,以及实现 LLM 记忆的多种方法和相关研究成果。