算法论文8
北大等提出图像并行生成新范式
AIGC开放社区
AI 摘要
北大、字节等团队指出多模态模型先思考后作画存在缺陷,提出MMaDA - Parallel并行框架,构建ParaBench基准评估,通过多种优化,在测试中以小数据量击败Bagel,提升输出对齐指标。
阅读原文 · AIGC开放社区
北大、字节、中科院自动化研究所等提出图像并行生成新范式
北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
紫东太初GMC:少80%Token保多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
量子位
产品应用8
阿里「千问办公」公测,Qwen3.8 - Max上岗
8月,阿里「千问办公」开启公测,它整合三款产品,还接入最新旗舰Qwen3.8 - Max。该产品交付成果可用,可一站生成多模态内容和Office产物,与钉钉打通且有组织级Skill,优势明显。
新智元
产品应用8
Agnes AI实测:编程瓶颈在缓存命中率
本文实测Agnes AI,指出AI编程瓶颈在于缓存命中率,而非模型智商。介绍其产品线、评测成绩与价格优势,还分享客户端体验,包括亮点、回滚事故及日志结论,最后点明智能免费后验证更稀缺。
AI科技评论
新闻资讯8
Meta「芒果」生图紧追GPT Image 2
Meta推出图像生成模型Muse Image(代号「芒果」)和视频模型Muse Video预览版。Muse Image在文生图榜单排第二,改变画图方式,能自我修正。它与Muse Spark打通,Muse Video文生视频排第3。不过,其@功能有隐私隐患。
新智元