量子机器学习」共找到 1689 篇相关文章

算法论文7

Reasoning模型在RL下的探索欲望急速下降问题:探索熵机制

论文研究发现大模型经强化学习训练解题时,会出现模型探索欲望急速下降的熵崩溃现象,如训练初期策略熵断崖式下跌。对此进行规律分析、追根溯源,提出破解方法,研究对AI训练范式变革有重要意义。

深度学习自然语言处理
新闻资讯7

拒绝小扎15亿美元offer的大佬,还是加入Meta了

曾拒绝小扎15亿美元薪酬包的机器学习大神Andrew Tulloch加入Meta。他此前在Meta工作11年,后到OpenAI,今年1月随前CTO创立公司,两个月前还拒绝Meta邀约,现入职具体工作未知。

量子位
推荐文章7

Tool-Integrated RL 会是 Agents 应用突破 「基模能力限制」 的关键吗?

文章聚焦AI & Robotics业内要事,探讨Tool - Integrated RL能否助Agents突破「基模能力限制」,还涉及Copilots填产业落地鸿沟、生成式AI重塑软件开发等话题,完整版通讯含多项解读与要事速递。

机器之心
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼全脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼全脑活动的基准测试平台。它含超70000个神经元4D光片显微镜记录,设计多种刺激条件采集数据,有特定基准测试任务和评估指标。

AIGC开放社区
算法论文8

腾讯AI Lab首创RL框架Parallel-R1,教大模型学会「并行思维」

腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化学习让大模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数学基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。

机器之心
新闻资讯7

黄仁勋李飞飞林斌投了同一家机器人公司

Generalist是专注给机器人“造通用大脑”的AI公司,创立不久便多次融资,估值超20亿美元。其GEN - 1.5有强大泛化能力,演示一次就能上手,但也有很大进步空间,展示了未来通用机器人大脑学习方式。

量子位
开源动态8

Agent 自我改进的六条路

文章梳理了让 AI Agent 不重新训练就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训练、自我修改和编排自优化,介绍了各机制代表项目及成果,指出 AI 学习正从训练溢出到部署阶段。

AGI Hunt
推荐文章7

龙虾开始投简历了,月薪1万刀。

一只日本龙虾为应聘RevenueCat的AI员工,写15篇日记作为求职作品集。日记记录其从菜鸟到终极秘书的进化,展现犯错、复盘、改进的过程,体现AI从错误中学习的能力,也凸显人对AI调教的重要性。

探索AGI
推荐文章7

刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。

机器之心
推荐文章7

Kotlin Multiplatform 评估:跨平台开发中的优势与权衡

文章评估了 Kotlin Multiplatform(KMP)在跨平台开发中的优劣势。KMP 可共享代码,编译成原生代码获出色性能,保留原生 UI 选项。虽生态小、有学习曲线等问题,但 Netflix 等大公司已用,未来潜力大。

InfoQ