「LLM框架」共找到 2428 篇相关文章
首个多人对话视频生成框架MultiTalk,角色有表情还能互动
现有音频驱动人体动画方法多聚焦单人,处理多音频流能力弱、指令跟随有局限。中山大学提出多人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。
微软开源2025 ICML获奖框架,终结大模型多轮对话严重缺陷
微软开源2025年ICML获奖框架CoLLabLLM,可解决大模型多轮对话缺陷。它由四大模块构成,经多轮对话模拟和奖励优化模型。在三大基准平台测试显示,能在多样任务中高效协作。
告别无效计算!新TTS框架拯救19%被埋没答案,推理准确率飙升
现有TTS方法存在路径同质化和中间结果利用不足问题。华为诺亚方舟实验室等机构提出SRCA框架,含检查点注入、答案聚类搜索和检查点候选增强组件,实验显示能提升推理准确性、效率,降低成本。
这个框架让大模型省下50%内存,合并专家不如直接删掉?
Cerebras Research提出REAP框架,通过专家剪枝和合并技术压缩SMoE模型,能让模型‘瘦身’并保持性能,可省50%内存,但社区测试有不同结果,且存在调度开销等问题。
国产LLM大爆发的一周,Hugging Face热榜被承包了!
这一周国产开源LLM集中爆发,GLM - 4.5、Qwen3的5连发、Step3等接连发布。GLM - 4.5是新一代开源SOTA模型;Qwen3各版本在不同能力上提升显著;Step3是多模态推理模型;腾讯还发布了混元3D世界模型1.0。
CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning
大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。
LLM 没意思,小扎决策太拉垮,图灵奖大佬 LeCun 离职做 AMI
图灵奖得主 Yann LeCun 宣布年底从 Meta 离职创业,聚焦高级机器智能研究项目 AMI。他离职是因与 Meta 在 AI 发展路线上冲突,且不满 LLM,坚持基于“世界模型”的下一代 AI 技术。
ICCV 2025 | 港科、牛津大学发布AlignGuard,文图生成模型可规模化安全对齐框架
随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津大学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。
首个GUI多模态大模型智能体可信评测框架+基准:MLA-Trust
MLA-Trust 是首个针对 GUI 环境下多模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。
告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性?
文章指出LLM推理非确定性根源并非GPU并发和浮点非结合性,而是批大小变化致核函数非不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。