零样本扩展」共找到 913 篇相关文章

6

增长密码:大型网站百万流量运营之道

本书深入探讨了大型网站SEO的底层逻辑,从系统能力、协作能力到创新能力,通过作者亲自操盘的成功案例,揭示了大型网站流量增长的秘诀。书中不仅分享了成本获客的策略,还涵盖了被动式营销的要领,让读者能够快速掌握SEO的核心技巧。

胡勇
算法论文8

人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练

人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。

AI科技评论
算法论文8

27M参数战胜GPT-4!脑启发的分层Reasoning引擎如何重塑LLM

当前大语言模型(LLM)核心架构存在根本性缺陷,受大脑分层处理和多时间尺度启发,本文提出仅2700万参数的分层推理模型(HRM),免预训练与CoT标注,单次前向传播解决复杂任务,在ARC - AGI上超越GPT - 4等LLM。

深度学习自然语言处理
推荐文章7

太多人误解了「苦涩的教训」

《“苦涩的教训”》一文常被误解,其核心观点是能充分利用计算资源扩展的方法会超越不能扩展的方法。人类知识短期易获好结果,但长远看,唯有随算力增长的方法最终胜出,如深蓝、AlphaGo Zero的案例。

宝玉AI
算法论文8

ICML 2026 | 华为GTS提出AI训练数据新方法,Amazon/Google作者团队「光速跟进」:难度自适应训练正在成为新范式

华为GTS研发部AI数据团队提出EDCO方法,将样本难度估计与动态课程编排引入领域大模型微调。该方法用推理熵动态编排训练课程,让模型面对最有学习价值的样本,已被ICML 2026接收。

机器之心
算法论文8

上交大54页综述讲透Agent认知外部化的演进之路

上海交大联合多机构提交综述论文,首次以「外部化」为统一视角,梳理了LLM Agent的记忆、技能、协议与Harness工程四大支柱。指出Agent实际进展取决于外部认知基础设施,而非模型能力提升。

机器之心
算法论文7

SceneWeaver:面向通用三维环境生成的反思型智能体框架

室内场景合成在具身智能兴起下愈发重要,现有方法存在局限。BIGAI提出SceneWeaver框架,通过基于工具的迭代优化统一多样场景合成范式,具有高保真模拟、强健物理交互等优势。

带你学AI
产品应用7

Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流

Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。

InfoQ
产品应用7

人形机器人终于学会洗碗了

Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。

量子位
算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元