「国产LLM」共找到 1410 篇相关文章
通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持
LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。
人类或将沦为“NPC”!智谱创始人唐杰最新研判:LLM正从攻克长程任务到全自主进化
智谱创始人唐杰认为今年LLM技术突破点在长程任务,能在智能体环境交互完成复杂任务。随能力提升,将迈向‘无人公司’时代,人类或成‘NPC’。后续要攻克记忆、学习等技术,实现自我进化,重塑产业。
NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻
北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。
国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%
继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队多来自 AMD,产品覆盖多领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。
告别微调时代:拖拽式LLMs实现12000倍加速适配,输入描述,秒级定制LLM,效果、速度全面超越
传统高效微调技术成大规模部署瓶颈,论文提出Drag-and-Drop LLMs (DnD),仅需输入目标任务未标注提示,即可秒级生成适配的LoRA权重,实现LLM秒级免训练适配,效率、性能和泛化性上均有突破。
这款拿下 10k+ Star 的开源 LLM DevOps 平台,如何帮企业“批量孵化”AI 应用?——BISHENG 深度上手
BISHENG 是面向企业级场景的开源 LLM 应用 DevOps 平台,支持 GenAI 工作流等完整能力,已在众多头部组织落地。它围绕企业痛点搭建,有灵思 Agent、可视化工作流编排等亮点,适用于多场景。
小红书开源大模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……
小红书hi lab团队公布首个开源大模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度大,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。
让64张卡像一张卡!浪潮信息发布新一代AI超节点,支持四大国产开源模型同时运行
浪潮信息发布新一代AI超节点“元脑SD200”,可让64张卡像一张卡。它支持四大国产开源模型同时运行,实现算力聚合突破,通过软硬协同优化提升推理性能,采用开放架构推动“智能平权”。
LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!
文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。
小红书 AI 搜索负责人高龑确认出席 QCon 上海,分享小红书搜索的 LLM 进化之路
10月23 - 25日,QCon全球软件开发大会将在上海举办,聚焦多热门话题。小红书AI搜索负责人高龑将分享《从“搜内容”到“问AI”:小红书搜索的LLM进化之路》,介绍搜索实践及大模型应用经验。