模型参数量」共找到 8208 篇相关文章

新闻资讯8

GPT-5.1发布当天,文心5.0杀回来了

2025百度世界大会发布文心5.0,这一2.4万亿参数的原生全模态模型,训练之初融合多模态数据,支持联合输入输出。同日OpenAI推出GPT - 5.1,文心5.0在多方面表现出色,如情绪安抚更贴心、多模态理解能力强等。

新智元
算法论文8

语言反思>强化学习:伯克利新架构碾压传统RL

大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标奖励,仅用传统方法1/35计算,性能最高提升19%。

深度学习自然语言处理
新闻资讯8

同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生全模态文心5.0

2025年,OpenAI凌晨更新GPT - 5系列,百度在世界大会发布文心5.0。它采用原生全模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。

机器之心
新闻资讯7

顶模 Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
新闻资讯8

一年拿下三轮融资!影目INMO正在鼻梁上“复刻”一个AI手机

影目INMO在一年拿下三轮融资,近5亿资金到位。其产品INMO GO3等表现出色,首发预订可观。该公司专注轻化一体式AI+AR眼镜,结合自研系统与智谱大模型,还拓展线下渠道,全球化布局也在推进。

量子位
算法论文8

NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了

大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和推理速度。

机器之心
产品应用3

小美Agent:当龙猫遇到美团外卖的灾难现场

作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。

AI产品黄叔
新闻资讯7

ChatGPT正式上线广告主平台,AI产品从今天开始走向分裂。

今日凌晨,OpenAI更新ChatGPT,上线非推理模型GPT - 5.5 Instant,还官宣向企业主全上线广告平台。此前广告已在部分地区测试,付费和未成年用户无广告,免费用户可选择关闭但功能受限。投放端向美企开放,出价高,这或成AI产品宿命。

数字生命卡兹克
产品应用8

Meta「分割一切」进入3D时代!图像分割结果直出3D,有遮挡也能复原

Meta MSL实验室发布三维重建模型SAM 3D,其家族的两个新模型能将2D图像转为3D重建模型,性能优异。同时,此前投稿ICLR 2026的SAM 3也亮相,可克服传统模型局限,在多项任务中刷新SOTA。

量子位
产品应用8

MoE推理「王炸」组合:昇腾×盘古让推理性能狂飙6-8倍

在通往AGI进程中,MoE模型成大模型推理提效关键。华为推出Pangu Pro MoE 72B模型,经多方面优化,推理性能提升6 - 8倍。还采用多种策略和算法,在昇腾不同平台展现卓越性能,为大模型落地提供支撑。

机器之心