多模型支持」共找到 9750 篇相关文章

新闻资讯7

直播预约 | 迈向用于演绎推理的诚实语言模型

本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能。

深度学习自然语言处理
推荐文章7

评论送书 | 一文读懂Agent系统演进趋势

文章指出Agent系统成大模型应用重要方向。分析大模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。

AIGC开放社区
产品应用8

Google Gemini Embedding2:一个模型处理所有媒体类型

Google发布Gemini Embedding 2,首个原生模态嵌入模型。能处理文本、图像等种媒体类型,持交错输入,覆盖超100种语言。与模型串联方案比,延迟降70%、召回率升20%。已可在Gemini API等使用。

AI工程化
新闻资讯8

真正面向大模型的AI Infra,必须同时懂模型、系统、产业|商汤大装置宣善明@MEET2026

商汤大装置副总裁宣善明在MEET2026大会分享进展,强调大模型时代AI Infra要解决算力高效撑问题。商汤战略“1+X”,大装置有优势,算电协同成果好,还推动国产化适配,产业落地成果

量子位
算法论文8

模型「漂移」新范式,何恺明新作让生成模型无须迭代推理

训练生成模型复杂,传统扩散模型训练费时费力。何恺明团队提出「漂移模型」新范式,不依赖微分方程,持一步推理,实验验证其在领域性能佳,有望解决生成式AI质量与效率权衡问题。

机器之心
算法论文8

启发学习:让大模型认知从外化到内生

当下大模型能力靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。

机器之心
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发新模型

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。

AI前线
开源动态8

Jina-VLM:可在笔记本上跑的语言视觉小模型

Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,持 29 种语言,能高效处理问答等任务,对硬件需求低。

Jina AI
开源动态8

LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典

Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅持Python。

量子位
推荐文章7

大小模型协同架构在金融智能投顾中的应用与挑战

本文整理自北银金科高级算法专家尹辰轩分享,介绍大小模型协同架构下的大模型投顾方案,能解决幻觉问题、优化回答深度。还提到 12 月 19 - 20 日 AICon 北京站聚焦热门方向。

InfoQ