产品应用8
蚂蚁LLaDA2.1:扩散模型速度质量兼得
AIGC开放社区
AI 摘要
蚂蚁集团:LLaDA2.1引入‘草稿 - 编辑’机制,有极速和质量两种模式。采用混合训练与强化学习,在33个基准测试表现佳,代码生成速度超800 TPS,兼顾速度与质量。
阅读原文 · AIGC开放社区
蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得
蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
北大团队推MathDebugger,提升合成数据质量
随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。
InfoQ
算法论文8
蚂蚁OmniTable驯服3050亿条训练数据
蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中大幅缩短周期。
量子位
新闻资讯7
Google发布Gemini 3.8双版本抢智能体入口
9月2日,Google发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。前者用于编程等,已稳定上线;后者专用于发现修复漏洞,仅向特定方开放。二者共享基础能力,采用不同安全限制和部署环境。
AIGC开放社区
新闻资讯7
OpenAI Astra核心架构:循环深度引争议
The Information记者爆料OpenAI即将推出的Astra模型采用“recurrent depth”新推理方法,该技术能降本提效,但引发AI安全与可观测性担忧。清华与字节论文解决了循环模型“算力不公平”问题,并给出Scaling Law。
AI寒武纪