多模型策略」共找到 9909 篇相关文章

开源动态7

谢赛宁也玩MC?开源全新世界模型生成人一致的游戏视角

电子游戏推动AI发展,谢赛宁团队探索世界模型新方向,推出人视频世界模型Solaris。该模型能生成人一致的第一视角,团队还搭建了人数据采集系统SolarisEngine,构建了人Minecraft数据集。实验结果显示,其方法在方面表现更优。

机器之心
推荐文章8

推荐系统进入“大模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地

文章基于华为郭威在2025 AICon大会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
新闻资讯7

独家|浙大00后世界模型创业,完成新一轮亿元融资,已在个产业领域实现交付

2021年浙大陈天润成立魔芯科技,早期围绕AI驱动3D内容生成。2024年底转向3D场景建模和世界模型,走纯隐式方法。团队年轻有优势,已产生收入,完成融资,将推新模型,目标是实现‘3D的ChatGPT时刻’。

DeepTech深科技
算法论文8

直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?

该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
算法论文8

可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25

研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。

新智元
开源动态8

小米开源首个跨域具身基座模型MiMo-Embodied,29个榜单SOTA

小米具身智能团队开源跨域基座模型MiMo - Embodied,它融合自动驾驶与具身智能,在29个榜单创SOTA。该模型基于MiMo - VL架构,采用四阶段训练策略,有效解决领域割裂问题,为通用VLA模型奠定基础。

机器之心
算法论文8

从打分器到思考者:RM-R1用推理重塑模型价值判断

伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。

机器之心
开源动态8

百度开源文心4.5系列10款模型项评测结果超DeepSeek-V3

今日百度正式开源文心大模型4.5系列10款模型,涵盖不同参数规模。该系列模型文本和模态基准测试达SOTA,项评测超Qwen3、DeepSeek - V3,还具备三大关键创新,获开发者关注。

Founder Park
算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
开源动态8

快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!

快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程环节深入分析,给出优化策略

AI前线