大模型部署」共找到 9430 篇相关文章

推荐文章7

揭秘模型评测:如何用“说明书”式方法实现业务场景下的精准评估

文章系统性介绍业务场景下模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。

阿里云开发者
算法论文8

模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了

语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等多方面内容。

机器之心
推荐文章7

Andrej Karpathy深度解读:强化学习之父为何说模型违背了「苦涩教训」

Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。

AGI Hunt
算法论文8

一个模型统一4D世界生成与重建,港科One4D框架来了

港科研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。

机器之心
推荐文章8

阿里云CIO首次系统复盘:模型落地的RIDE方法论与RaaS实践突破

阿里云智能集团 CIO 蒋林泉分享模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。

InfoQ
开源动态8

AI秒懂短视频,快手模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
推荐文章8

科普向:一文解构模型后训练,GRPO和它的继任者们的前世今生

文章深入解读模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。

机器之心
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。

AIGC开放社区
新闻资讯7

中国模型如何破圈?开源不能太“独角戏”,也不是“上传 GitHub 就完事儿”

InfoQ 专访 Linux 基金会 Mark Collier,他分享对 AI 时代开源看法。指出开源是协作哲学,AI 开源与传统不同,倡导开放数据,认为商业限制不利生态,还谈及 Agent 与中国模型开源等问题。

InfoQ
新闻资讯8

模型记忆系统 MemOS 2.0:StarDust 技术演进与关键挑战|QCon 北京

4月16 - 18日QCon北京会聚焦Agentic AI等前沿话题,记忆张量CTO李志宇将分享《模型记忆系统MemOS 2.0:StarDust技术演进与关键挑战》,梳理技术演进,推出MemOS 2.0 StarDust,还分析实践痛点与演讲亮点。

InfoQ