大模型3.0」共找到 9992 篇相关文章

产品应用8

三星研究院发布手机端侧模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
开源动态8

华为| 祭出FlashComm1,FlashComm2、FlashComm3,解决LLM推理通算瓶颈

模型推理面临通算难题背景下,华为数学家祭出FlashComm 1、2、3。如FlashComm 1优化AllReduce通信,提升推理性能;FlashComm 2重构计算流程,提升推理速度;FlashComm 3实现多流并行,激增模型吞吐。

AINLPer
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强泛化能力。

量子位
开源动态8

浙江学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础模型

2025年9月18日,浙江学任奎教授团队联合华为在“华为全联接会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。

AIGC开放社区
新闻资讯7

SpAItial发布超逼真3D空间基础模型

德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,可基于文本或图片生成3D场景,在多领域有革新可能,虽有竞争,但未来有望推动AI三维突破。

AIGC开放社区
开源动态8

NeurIPS 2025 | 中科、港中深、通义千问联合发布CoRT:仅30个样本教会模型高效推理,token消耗降低50%

型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科、港中深、通义千问联合推出CoRT框架,用创新数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心
新闻资讯8

哈佛《Science》研究:模型已碾压人类医生!

哈佛医学院等团队让OpenAI o1系列模型与数百位医生在多项测试中较量,模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。

AIGC开放社区
新闻资讯7

刚刚,Meta 发布新模型,股价涨 10%

Meta发布新模型Muse Spark,是原生多模态推理模型,支持多种功能。其沉思模式处理复杂问题表现佳,还有新购物模式。虽评论区有质疑,但Meta股价涨。模型未开放API等,实际实力待察。

AGI Hunt
新闻资讯8

VAST完成5000万美元A轮融资,加速构建世界模型与UGC互动内容平台

通用人工智能公司 VAST 完成 5000 万美元 A 轮融资,由阿里、恒旭资本联合领投。该公司在 3D 领域成果显著,发布全新 AI 3D 模型家族,还将重点投入世界模型研发和 UGC 互动内容平台建设。

机器之心
新闻资讯7

Token售卖已无溢价、模型公司转型“系统商”?记忆张量 CTO 李志宇:智能体能力会拉开差距,长期记忆与状态管理成竞争核心

InfoQ 采访记忆张量 CTO 李志宇,他指出 Scaling up 经济效益下降,模型公司正变系统公司,核心是长期记忆与状态管理能力。2026 年若模型无代际差,价格战或加剧。智能体是主赛道,但现有模型推理能力不足。

InfoQ