多模型编排」共找到 9679 篇相关文章

算法论文8

AAAI 2026 Oral | 拒绝「一刀切」!AdaMCoT:让大模型学会「看题下菜碟」,动态选择最佳思考语言

语言大模型面临语言选择难题,现有跨语言推理方法存在缺陷。新加坡研究团队推出AdaMCoT框架,通过自适应路由机制动态选语言推理,提升跨语言事实推理准确性与一致性,效果超越传统方法。

机器之心
产品应用8

别再纠结选哪个模型了,这个项目让它们一起干活!豪赠1亿token,羊毛薅起来!

元脑企智 EPAI 推出「模融合」API,让模型围绕同一任务协同工作。经代码生成、财务分析等测试及权威评测,效果出色。还采取智能调度等策略,现限时申请可免费使用,豪赠1亿token。

GitHubStore
开源动态8

9.1K Star 调参师集体失业!亚马逊造出机器学习“核弹”,3行代码打造高精度模型

在机器学习普及的当下,自动化机器学习框架降低开发门槛。AutoGluon由AWS AI开发并开源,仅3行代码就能训练和部署高精度模型,支持类型数据,有诸亮点,已获9.1K Star。

开源星探
开源动态8

小红书发布FireRedChat:首个可私有化部署的全双工大模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工大模型语音交互系统FireRedChat,可将半双工链路升级为全双工,提供级联与半级联服务,在指标领先,让AI有“人感”。

机器之心
产品应用8

上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”

上海人工智能实验室发布新一代模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。

OpenMMLab
开源动态8

腾讯混元AI开源3D世界生成模型!文图即可生成3D沉浸式场景!

腾讯混元AI实验室开源HunyuanWorld 1.0,这是业界首个支持沉浸式、探索性和交互性3D世界生成的全开源模型。它能通过文图生成3D场景,为领域提供支撑,还给出安装和代码使用示例。

开源星探
新闻资讯8

定义RAG新基准?谷歌发布 Gemini Embedding 2:首个原生模态嵌入模型,延迟骤降70%

谷歌昨夜推出首个基于 Gemini 架构的原生模态嵌入模型 Gemini Embedding 2,通过 Gemini API 和 Vertex AI 向开发者公开预览。它可将类型数据映射到统一嵌入空间,项基测排名第一,还获早期合作伙伴高度评价。

InfoQ
新闻资讯7

Grok 4刷新ARC-AGI-2纪录:15.9%碾压所有公开模型,我们离AGI还有远?

xAI的Grok 4在ARC-AGI-2测试中获15.9%,成全球最强公开AI模型。ARC Prize主席还原测试过程,虽成绩亮眼,但网友有质疑,且离人类表现差距大。Grok 4在基准测试领先,定价便宜。

AGI Hunt
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
开源动态8

腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配

音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景

开源星探