大模型开发」共找到 10003 篇相关文章

产品应用8

AI真能搞钱了!这家公司把模型玩成闭环赚钱机器

当全行业还在卷模型参数、烧算力时,零犀科技走出不同路。其自研因果模型,用AI智能体帮企业提升销售。2025年已实现规模盈利,成为最早跑通商业闭环的模型应用公司。

量子位
算法论文7

AI根本守不住秘密!不依靠模型的输出过滤才是铜墙铁壁

开发者常把秘密放系统提示词,以为安全。Swept AI和密西根学团队测试发现,攻击者不断尝试,AI会泄露秘密。多种依赖模型的防御方案失败,只有输出过滤能零泄露。

AIGC开放社区
产品应用7

多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造高效经济的模型存储平台

有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。

InfoQ
开源动态8

王兴一鸣惊人!美团首个开源模型追平DeepSeek-V3.1

美团首个开源模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对模型的理解,还有新发现,且性能好、训练效率高。

量子位
推荐文章8

5 分钟搞懂开源模型选型核心维度,16G显卡也能选对

文章以作者自身经历引入,指出开源模型选型易陷入‘越越好’误区。讲透选型4个核心维度,含实操步骤与避坑指南,还介绍选后评估方法,助新手快速锁定适配模型

机器学习AI算法工程
产品应用8

千卡集群破壁之道:vivo视觉多模态模型训练效率跃迁实战

多模态模型在多领域需求增长,但千卡级 GPU 训练挑战。vivo AI 架构师王兆雄在会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ
算法论文8

多模态模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26

多模态模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北和山团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。

新智元
新闻资讯8

苹果放王炸!开放模型访问权、全家桶集成ChatGPT,人人能开发AI应用

苹果在“WWDC 2025”会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。

AIGC开放社区
新闻资讯7

Meta发最强模型打响价格战,小扎对谷歌贴脸开!北校友立

九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升、成本低,性价比高,但也遭质疑,模型下半场或比拼系统架构和智能体工程能力。

新智元
算法论文8

模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!

随着语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。

深度学习自然语言处理