「大模型适配」共找到 9270 篇相关文章
AI真能搞钱了!这家公司把大模型玩成闭环赚钱机器
当全行业还在卷大模型参数、烧算力时,零犀科技走出不同路。其自研因果大模型,用AI智能体帮企业提升销售。2025年已实现规模盈利,成为最早跑通商业闭环的大模型应用公司。
AI根本守不住秘密!不依靠大模型的输出过滤才是铜墙铁壁
开发者常把秘密放系统提示词,以为安全。Swept AI和密西根大学团队测试发现,攻击者不断尝试,AI会泄露秘密。多种依赖大模型的防御方案失败,只有输出过滤能零泄露。
多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造高效经济的大模型存储平台
有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍大模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。
王兴一鸣惊人!美团首个开源大模型追平DeepSeek-V3.1
美团首个开源大模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对大模型的理解,还有新发现,且性能好、训练效率高。
千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战
多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。
端到端语音模型:从语音表征到模型架构
本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。
多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26
多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。
Meta发最强模型打响价格战,小扎对谷歌贴脸开大!北大校友立大功
九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升大、成本低,性价比高,但也遭质疑,大模型下半场或比拼系统架构和智能体工程能力。
大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!
随着大语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。
猛涨25k star!一键检测你的电脑能跑哪些大模型!
最近 Github 出现工具 `LLMFit`,用 Rust 编写,能自动检测硬件配置,判断大模型能否流畅运行,推荐最优量化版本和运行模式。有一键硬件检测等特性,安装使用方便,降低本地部署门槛。