「自回归扩散框架」共找到 2005 篇相关文章
拿下3D生成行业新标杆!昆仑万维Matrix-3D新模型鲨疯了,一张图建模游戏场景
昆仑万维推出3D世界生成框架Matrix - 3D,能从单图像生成高质量、轨迹一致的全景视频并还原可漫游3D空间。它优势明显,还突破多项技术难题,背后是昆仑万维对空间智能的战略布局。
阿里开源电影级AI视频模型!MoE架构,5B版本消费级显卡可跑
阿里开源新一代视频生成模型通义万相Wan2.2,含文生视频等功能。它率先将MoE架构用于视频生成扩散模型,5B版本可在消费级显卡部署。对比前代和Sora表现更优,还推出电影级美学控制系统。
Day0迁移、一键部署,华为开源的昇思MindSpore成为大模型开发的“万能钥匙”
在大模型无法一统天下的背景下,开发者面临在一个框架、生态体验众多主流大模型和AI技术的难题。华为开源的昇思MindSpore可实现训练Day0迁移、推理一键部署,还介绍了其相关技术和实测效果。
极低成本,复现GPT-4o图像风格化一致性!NUS推出OmniConsistency
NUS ShowLab 推出 OmniConsistency,解决开源扩散模型在图像风格化一致性上与商业 API 的差距。它成本低,能在保持风格化效果时精准保留图像细节等,还解决了风格化与一致性的跷跷板问题,且兼容性强。
从打分器到思考者:RM-R1用推理重塑模型价值判断
伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。
1盒内存条堪比上海1套房?内存涨价凶猛,业内人士:有钱的,上亿资金囤货
2025年7月以来,全球DRAM市场经历“史上最强”涨价周期,多数品类涨幅超100%。因产能吃紧、涨价预期等因素,囤货行为从下游扩散到大型贸易商等。本轮价格回升非因消费电子复苏,供需矛盾难缓解,市场现“恐慌性采购”。
2.4万亿参数原生全模态,文心5.0一手实测来了
文心5.0正式发布,主打原生全模态,支持全模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列全球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。
只用国产GPU训练的大模型性能飙升100%!国内唯一,更懂你
科大讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音大模型架构,效果提升、成本降低。此外,展示多领域应用成果,发布相关产品,开源智能体平台。
Cursor为Blackwell从零构建MXFP8内核,MoE层提速3.5倍,端到端训练提速1.5倍
Cursor团队从NVIDIA的Hopper H100s升级到Blackwell B200s后遇性能瓶颈,他们回归基础,从零重写MoE训练层,抛弃对现有CUDA库依赖,释放了Blackwell架构潜能,实现MoE层和端到端训练提速。
华为版CUDA,全面开源了
华为宣布为昇腾AI GPU开源CANN软件工具包及Mind系列套件、工具链,让昇腾更好用。CANN类似华为版CUDA,目前到8.0版,支持多深度学习框架。同日,传奇GPU架构师创业公司浮出水面,挑战英伟达。