多模型推理」共找到 9928 篇相关文章

算法论文7

PolyVivid实现主体视频定制,身份一致性超越现有模型

现有视频生成模型主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在方面优于现有方法,还介绍技术原理、演示效果,证明其在领域有实用价值。

带你学AI
产品应用7

实测新版LiblibAI:终于把模型、生图、工作流塞进一个碗了

本文实测新版LiblibAI,它上线模型,添加视频特效玩法。从“找模型”网站变为“AIGC流水线”平台,界面风格转变。虽有亮点,但也存在出图慢、模型惊喜感弱、页面卡顿等问题。

量子位
算法论文7

模型的第一性原理:(三)信息论篇

本文从信息论角度解读大模型第一性原理。介绍Shannon信息论,提出将其从以BIT为中心转换为以TOKEN为中心解释大模型底层原理,还阐述大模型各阶段信息论原理、定向信息计算方法,对比Granger与Pearl因果。

机器之心
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
算法论文8

这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。

AINLPer
算法论文8

无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%

西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。

机器之心
产品应用7

快手提出强化学习创新框架RLEP,突破大模型推理瓶颈

OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。

AIGC开放社区
产品应用7

刚刚发现,Claude桌面版支持第三方模型了,没账号也可以用Cowork,开关在这

作者年初后无法用Claude账号,上周五发现Claude桌面版(Mac)支持第三方模型,开关隐蔽。还介绍配置方法,以及Claude Cowork和Code模式特点,最后提及新模型及个人模型使用情况。

MacTalk
算法论文8

脸谱心智陆弘远团队ACL 2026新作:别再给模型叠加「高级词」了!模型更爱听「大白话」

脸谱心智与香港中文大学科研人员中稿 ACL 2026 的新工作提出 Adam’s Law,即文本频率定律,揭示文本频率对模型训练及推理的重要性,还给出工程解法,实验效果显著,为行业带来新思路。

机器之心
产品应用7

时隔一年,再次使用7个国产AI大模型写高考作文,国产模型的进步也太大了!有彩蛋。

去年评测国产模型写高考作文能力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型,能力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。

开源AI项目落地