大模型架构图」共找到 9832 篇相关文章

推荐文章8

Andrej Karpathy 爆火演讲刷屏技术圈:AI 开启软件 3.0,重写一切的时代来了!

Andrej Karpathy 在旧金山 AI 创业学校演讲,指出 AI 开启软件 3.0 时代,自然语言成编程接口。软件经历 1.0 代码、2.0 神经网络权重,现进入 3.0 用提示词编程模型阶段,还探讨模型特性、应用及相关问题。

InfoQ
开源动态8

阶跃新模型快到“没推理”!印奇上任,果然气势一新

印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配多家芯片厂商,在多场景表现出色,还具备端云协同能力,架构也有多项优化。

量子位
开源动态8

蚂蚁出手VLA,就是开源超越Pi0.5的基座模型

当前具身智能落地面临泛化能力不足的挑战,蚂蚁灵波开源发布的基座模型 LingBot-VLA 带来突破。它基于量真实世界数据预训练,在多项真机任务测试中超越 Pi0.5,且在架构、效率等方面有创新。

机器之心
新闻资讯8

地平线首曝BPU「黎曼」架构,用数学流形重构AI计算

2025 年 12 月 8 日深圳举办的地平线技术生态会上,地平线首曝 BPU「黎曼」架构,用数学流形重构 AI 计算。还发布第四代编译器,推出 HSD Together 模式,开源具身智能模型,欲构建物理 AI 世界底层生态。

机器之心
开源动态8

告别模型“失忆”!人开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

中国人民学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。

深度学习自然语言处理
算法论文8

NeurIPS 2025|CAKE:模型驱动的贝叶斯优化新配方,让黑箱优化更智能、更高效

香港中文学(深圳)等高校研究人员提出 CAKE 方法,被 NeurIPS 2025 接收。它利用语言模型动态设计高斯过程核函数,构建自适应贝叶斯优化框架,在多领域实验中效果优,还具备可解释性。

机器之心
新闻资讯7

AI行业的底牌已经亮完了,模型能力趋同后,拼什么?

Databricks MVP Adi Polak分析AI人才需求,指出能搭建评估管道等的工程师是硬通货。前沿模型架构趋同,行业从技术竞赛转向生态战争,比拼产品和用户理解能力,还为转型工程师给出建议。

AI工程化
算法论文8

网络基础设施如何支撑模型应用?北京学刘古月课题组5方向研究,相关论文入选ACM SIGCOMM 2025

在智能计算和网络演进背景下,北刘古月课题组聚焦网络研究。其 5 篇论文入选 ACM SIGCOMM 2025,从架构、数据、运维、安全四个维度形成技术闭环,推动新一代网络系统发展。

AI前线
新闻资讯7

Meta亿元天团首个模型交卷!余家辉宋飏Jason Wei耗时九个月,一雪Llama前耻

Meta超级智能实验室耗时9个月推出原生多模态模型Muse Spark,发布后股价拉升。它让Meta在第三方测评中赶上第一梯队,虽在编程和长时间自主运行有差距,但在多模态理解等方面表现突出,不过也有编程翻车情况。

量子位
新闻资讯8

国产AI高考708分,这款模型靠什么成为「屏蔽生」?

高考放榜,媒体对国内外模型进行测试。综合成绩上,讯飞星火X2物理、历史类表现优异;单科专项中,它在数学、作文等测试也领先。其优势源于数据积累、理解评判标准,还采取软硬件一体化落地路径。

机器之心