零样本学习」共找到 1780 篇相关文章

算法论文8

微调已死?Google 和斯坦福论文指出AI 学习新范式

Google的ReasoningBank和斯坦福的ACE两篇新论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。

AI工程化
推荐文章7

《AI时代下,中国低/代码市场发展研究》报告正式发布 | LowCode低码时代

《AI时代下,中国低/代码市场发展研究》报告发布,指出低/代码技术渗透率提升,主流厂商提供全链路方案。生成式AI与低/代码融合成趋势,市场稳定增长,企业对平台综合能力要求提高。

AIGC开放社区
新闻资讯7

速递|前字节Seed强化学习专家孙鹏加入星尘智能,将大模型后训练经验带到物理世界

9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。

AI前线
算法论文8

0人工参与实现梯度更新!MIT新框架让AI自动生成微调数据,权重自主升级

MIT提出新强化学习框架SEAL,可让模型生成微调数据和自我更新指令,实现权重更新。无需人工,模型能自动梯度更新。经知识注入和小样本学习实验验证效果,还介绍了其双循环工作机制。

量子位
产品应用7

Orion:面向注重隐私用户的新型浏览器——遥测、广告、防范 AI 追踪

Kagi发布新型浏览器Orion 1.0,默认注重隐私、遥测、无集成广告跟踪技术。它支持Chrome和Firefox扩展,将AI排除核心以保安全,资金源于付费订阅。不过因非开源,隐私声明遭质疑。

InfoQ
算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式

上海人工智能实验室提出策略判别学习(POLAR)新范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能和泛化性优越。

量子位
算法论文8

绝对监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
新闻资讯7

ChatGPT大更新推出学习模式!“一夜之间1000个套壳应用又死了”

ChatGPT大更新,推出学习模式,像老师般引导思考,对多类用户开放。它由OpenAI与多方合作打造,结合学习科学成果。目前用提示词实现,未来会训练进模型,还将多方面改进,或重塑教育模式。

量子位
产品应用7

当AI让答案唾手可得,学而思想把学习过程找回来

AI让答案不再稀缺,学生面临新挑战。7月3日学而思发布2026旗舰新品,提出学习机应陪孩子理解、练习、进步,将诊断、学习等环节连成路径,强调不替孩子学,保护学习过程。

机器之心
算法论文8

RSS 2025|从说明书学习复杂机器人操作任务:NUS邵林团队提出全新机器人装配技能学习框架Manual2Skill

新加坡国立大学邵林团队提出 Manual2Skill 框架,利用 VLMs 将说明书视觉指令转化为机器人装配技能,含层级化装配图生成、分步骤位姿估计、动作生成与执行三阶段,实验验证其在多场景的有效性。

机器之心