大模型记忆」共找到 9382 篇相关文章

推荐文章8

阿里云CIO首次系统复盘:模型落地的RIDE方法论与RaaS实践突破

阿里云智能集团 CIO 蒋林泉分享模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。

InfoQ
开源动态8

AI秒懂短视频,快手模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
推荐文章8

科普向:一文解构模型后训练,GRPO和它的继任者们的前世今生

文章深入解读模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。

机器之心
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。

AIGC开放社区
新闻资讯7

中国模型如何破圈?开源不能太“独角戏”,也不是“上传 GitHub 就完事儿”

InfoQ 专访 Linux 基金会 Mark Collier,他分享对 AI 时代开源看法。指出开源是协作哲学,AI 开源与传统不同,倡导开放数据,认为商业限制不利生态,还谈及 Agent 与中国模型开源等问题。

InfoQ
算法论文7

多模态模型挑战北京杭州地铁图!o3成绩显著,但跟人类有差距

近年来,多模态模型在多种场景取得进展,但能否‘看懂图’存疑。西湖学等团队提出评测基准ReasonMap,评估模型在地铁图理解中的能力,发现主流模型有瓶颈,闭源模型虽优但仍逊于人类。

量子位
算法论文8

基础模型已颠覆科研,进入第五范式!港科综述113篇论文 | NeurIPS'25

港科论文指出,随着科学问题复杂度提升,传统科研范式显露出局限。基础模型(FMs)横空出世,具备通用性、规模与知识覆盖、推理与生成能力,可能引领科学进入第五范式,但也面临偏见、幻觉等问题。

新智元
算法论文8

首个多轮LLM Router问世, Router-R1可让模型学会「思考–路由–聚合」

语言模型种类爆炸的时代,如何智能分配任务成新挑战。伊利诺伊学香槟分校团队发布 Router - R1,让 LLM 学会‘思考–路由–聚合’,用强化学习平衡性能与成本,在七基准测试表现出色。

机器之心
新闻资讯7

刚刚,马斯克Grok4干翻谷歌Gemini!o3杀入首届模型对抗赛决战

首届模型国际象棋对抗赛第二轮结果出炉,o3以4比0击败o4 - mini,Grok 4在加赛中战胜Gemini 2.5 Pro,二者挺进决赛。8月7日将迎来终局之战,国际象棋冠军将解说。

新智元
算法论文8

模型汤新做法!Meta|提出“类别专家汤”:SoCE,幅提升模型性能,刷新SoTA!

语言模型领域,提升性能常需高算力、量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。

AINLPer