「第二代AI预训练范式」共找到 11073 篇相关文章
首个开源实现100%可复现的稳定RL训练框架来了!2次结果完全重合
SGLang团队联合slime团队开源实现100%可复现的稳定RL训练框架。基于Qwen3 - 8B重复实验结果完美重合。SGLang在批次不变算子基础上实现确定性推理,性能有下降但有提升空间,还给出使用方法和未来规划。
5秒出4张2K大图!阿里提出2步生成方案,拉爆AI生图进度条
阿里智能引擎团队针对Qwen最新开源模型,将SOTA压缩水平从80 - 100步前向计算骤降至2步,速度提升40倍,5秒可出4张2K高清大图。已发布Checkpoint,集成到呜哩AI平台。文章还分析传统蒸馏方案问题并介绍团队改进策略。
Cursor已死,Claude当立!Anthropic用L4级Agent,正在“降维打击”整个AI编程赛道。
AI编程领域正上演变革,很多用户从Cursor转向Claude Code。Claude Code成本有优势且具L4级编程能力,其强大还冲击了生态。未来Agentic DevOps是黄金赛道,最终赢家或为有顶尖模型与云服务的玩家。
想挣全球用户的钱,比想象中得更复杂 | AI产品海外收款避坑指南
AI 产品出海,支付不只是接 SDK 这么简单,关乎产品收入增长。不同市场支付差异大,选错或忽视风控,会导致支付成功率低等问题。文章围绕全球变现、支付风控、避坑指南等问题,给出实践建议。
「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也能「明察秋毫」!
上海交通大学与蚂蚁集团联合团队发布多模态大模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型单次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性能。
AAAI 2026杰出论文奖 | ReconVLA:具身智能研究首次获得AI顶级会议最佳论文奖
具身智能常被视为‘系统工程驱动’研究方向,ReconVLA获AAAI杰出论文奖,是具身智能方向首次获AI顶级会议最佳论文。它解决VLA模型关键瓶颈,通过重建式隐式视觉定位机制,实验效果显著。
开源一周狂揽 7.6K Star!这个爆火的「同事.skill」可以将“数字遗产”炼成 AI!
开源项目colleague-skill上线不到一周获7600+ Star。它由@titanwings开发,可凭同事材料生成能替其工作的AI Skill,有双层架构、多源采集等亮点,还介绍了使用方法与项目结构。
Meta AI大洗牌!超级智能一拆四,小扎押注硅谷华人,LeCun或已出局
8月20日Meta半年内第四次重组AI部门,超级智能实验室一分为四,或弃Llama 4转闭源模型,开源理念动摇。Meta还进行财务和基建“加码”,此次重组或意味着从研究到工程落地的转移。
用Diffusion构建「AI虚拟细胞」,14项指标霸榜!Mila唐建团队破解单细胞「破坏性」测序难题
Mila唐建团队发表PerturbDiff,跳出前人认知盲区,将“细胞群体的概率分布”视为随机变量。它引入数学工具建模,让MMD内生于体系,在多项基准测试霸榜,还提供应对数据稀缺的思路。
Nature 正刊收录!清华 FIB 实验室揭示:AI 提升科学家个人影响力,却收缩科学整体探索空间
清华大学 FIB 实验室牵头研究表明,AI 在自然科学应用广泛,提升科学家个人影响力,但使科学整体探索空间收缩。研究基于大量论文和人员数据,还提出科研智能体系统 OmniScientist 缓解问题。