「蒙特卡洛搜索算法」共找到 955 篇相关文章
只有 30 个工程师的 X,是怎么重新杀回 App Store 第二的
本文讲述X产品负责人Nikita Bier的经历,他曾多次打造爆款App。加入X后,30人团队30天内将App Store排名从78推到2。他还分享X在算法、功能等方面的改进,以及Elon的管理风格和X未来计划。
量子计算摆脱GPU!IBM一句话AMD市值暴涨2000亿元:用FPGA芯片即可
IBM宣布在量子计算商业化取得重大进展,能在AMD芯片实时运行量子纠错算法,速度比需求快10倍,无需GPU,用FPGA芯片与量子计算机配合即可,这一突破让AMD和IBM市值均大幅上涨。
MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4
MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。
ICLR 2026 | 这道题是否需要用图思考?模型来告诉你!自适应思考模式切换助力通用视觉推理提升
本文来自复旦大学和阿里巴巴未来生活实验室,已中稿 ICLR 2026。目前视觉推理方法有纯文本和用图思考两种模式,各有优劣。研究者提出 Mixture-of-Visual-Thoughts 范式及 AdaVaR 框架、AdaGRPO 算法,让模型自适应选模式,实验显示其在多任务有提升。
只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题
阿里高德提出Tree - GRPO方法解决智能体RL难题。它以智能体步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。
欲取代transformer的SSA(次平方稀疏注意力)解读
文章解读了欲取代Transformer的SSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。
北大2篇Skill炸场,Agent彻底进化
北京大学连发两篇论文,给出让 Agent 变强的答案:让 Skill 自己进化。`SESA` 针对工具增强的搜索问答,用四个阶段闭环使任务生成和技能记忆一起进化;`VeriSkill` 把验证器废信号变成可信更新,二者场景不同但核心一致。
让推荐学会思考:用强化学习激活大模型的序列推理能力
文章指出推荐系统曾未紧密结合大模型能力,如今正靠近其训练范式。作者基于用户行为序列,用强化学习训练大模型理解序列关系,以预测用户下一个可能点击的资讯,并通过实验验证了该方法的可行性,还探讨了不同数据库中BM25算法的差异。
SEO们可以用AI做些什么?
文章围绕SEO与AI展开,介绍AI对搜索方式的改变、SEO前景,还阐述如何让品牌出现在AI回答及引用出处,以及AI在关键词研究、内容创作、站内SEO、外链建设等方面的应用,为SEO从业者提供新思路。
Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%
为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。