大模型输出」共找到 9221 篇相关文章

算法论文8

西工张伟伟团队:模型时代航空科技的蓝图畅想 | 航空学报CJA

随着国产开源模型涌现,语言模型走入生活,挑战传统航空教育,革新科研范式,与航空产业融合推动变革。西工张伟伟团队探讨其在航空工程教育、科研、行业全链条的影响及挑战。

力学与人工智能
算法论文8

模型上车:理想汽车硬件协同设计算出最佳边缘模型

长三角洲AI实验室、中科院、理想汽车等找到语言模型硬件协同设计寻优之路,在相同延迟下降低端侧模型困惑度,压缩模型架构挑选时间。研究揭示缩放定律,打造硬件感知建模框架,找到精度与延迟最优解。

AIGC开放社区
算法论文8

陈丹琦新作:模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越模型,推理更像人类。

量子位
推荐文章8

斯坦福模型推理课免费了,谷歌推理团队创始人主讲

谷歌DeepMind推理负责人Denny Zhou在斯坦福学CS25讲“LLM推理”课。模型推理是给出答案前的中间思考步骤,能让复杂问题可解、提升答案准确性。还介绍了让模型输出推理答案的方法及提升推理能力要点。

量子位
开源动态8

文心模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
算法论文8

华为中科联创模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科提出CBQ后训练量化方案,仅用0.1%训练数据实现模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
产品应用8

英伟达帮你省钱,让模型推理「短而精」,速度快5倍

过去模型推理追求长链思维,导致推理链长、Token消耗、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于模型

机器之心
开源动态8

国产类脑模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲模型SpikingBrain (瞬悉)-1.0,借鉴脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑模型生态。

量子位
产品应用7

豆包模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。

AI产品自由
推荐文章7

数据到好猜想:如何用模型做市场研究?

文章指出模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park