「硬件与模型协同」共找到 8272 篇相关文章
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
库克与苹果
苹果CEO库克宣布卸任,转任执行董事长。他在苹果28年,任CEO 15年,让苹果市值和营收大幅增长,打造强大供应链,推出多新品类。但造车项目取消,Vision Pro未打开大众市场,AI发展滞后。接班人是硬件工程师John Ternus。
斑马智行,开启汽车主动智能时代|甲子光年
2025年WAIC上,斑马智行联合通义及高通,首发行业首个基于高通8397平台的端侧多模态大模型解决方案。该方案让智能座舱从“被动响应”到“主动感知”,还打通产业链,实现多方面适配。
堆推理链全错了!林俊旸离职首曝:曾在阿里 Qwen 踩中一个“致命”技术误区
阿里千问技术负责人林俊旸离职后发声,复盘 Qwen 训练尝试,指出合并 thinking 和 Instruct 模式不理想。他认为大模型未来应从‘推理思维’走向‘智能体思维’,并阐述了智能体思维的特点和挑战。
游戏研发中的 AI 转型:网易多 Agent 系统与知识工程实践
本文整理自网易游戏高级技术经理林香鑫分享,介绍大模型在游戏研发落地实践。团队用代码知识谱图、多 agent RAG 召回等技术打造超级助手,在多业务场景落地,推动内部 AI 生成代码覆盖率提升。
Jina Reranker v3: 全新“列式”重排器,0.6B参数刷新文档检索SOTA
Jina AI推出第三代重排器Jina Reranker v3,在多语言检索基准上刷新SOTA。它参数仅6亿,有“last but not late”交互机制,能一次性处理查询和文档。还提供动态量化格式,方便不同硬件部署。
以「图」破局,HyperOffload定义超节点存储管理新范式
随着生成式AI进入万亿参数时代,大语言模型面临“显存墙”挑战。上海交大与华为MindSpore团队发布技术报告《HyperOffload》,其核心技术集成于MindSpore 2.8,能提升超节点异构资源协同效率,已在多项目落地。
DeepSeek-R1全升级V2版:Token成本低至原来30%
DeepSeek - R1 V2版全维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安全可控性,适配生态,推出轻量级模型。
商汤SenseNova U1深度拆解,原生统一架构终结缝合时代
文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。
什么样的龙虾,才是「一人公司」的心头好?
AI时代,OPC概念火热,但过往大模型和Agent难落地。面壁智能官宣EdgeClaw Box,采用端云两栖架构,安全高效,适配多款硬件,可插电即用,还能降成本、保障数据安全,集成多种Skills,助力OPC提效。