元学习」共找到 1993 篇相关文章

产品应用8

0.3B参数,600MB内存!腾讯混实现产业级2Bit量化,端侧模型小如手机App

腾讯混团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位
产品应用7

Claude Code 推出学习模式,比ChatGPT更激进:甚至能给你部署作业……

Anthropic为Claude Code和Claude应用推出全新学习功能,Claude Code支持切换交流风格,Learning模式像结对编程,会留作业。Claude实现方式比ChatGPT激进,开发者反响热烈,标志其向更智能教育方向发展。

AGI Hunt
算法论文8

经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning

该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。

深度学习自然语言处理
新闻资讯8

Yann LeCun最新纪录片首曝!传奇AI教父的双面人生,深度学习幕后40年

Yann LeCun新纪录片上线,回顾其深度学习四十年历程。他是深度学习开创者、Meta首席AI科学家,坚信机器应学会学习,认为AI竞争是开放与封闭之争,还对AI威胁论持务实乐观态度。

新智元
新闻资讯8

一图看透全球大模型!新智十周年钜献,2025 ASI前沿趋势报告37页首发

新智十周年峰会发布《2025新智ASI前沿趋势报告》与《2025新智ASI产业图谱》,预测2027达ASI临界,智能体全面爆发。报告展示全球大模型格局,中国开源模型表现亮眼,还揭晓了创新大奖。

新智元
新闻资讯7

微软这支神秘的华人AI团队加入腾讯混,曝与裁员无关|独家

WizardLM项目创建者徐灿发文称团队离开微软加入腾讯混。混此前发布多款AI模型,WizardLM也发布过混模型。该团队专注高级大语言模型开发,曾成绩斐然,但也面临模型部署挑战。腾讯大力投入AI,网友对此看法不一。

AI前线
算法论文7

一篇持续强化学习技术最新综述

文章对持续强化学习(CRL)进行全面考察,关注其核心概念、挑战和方法,提出新的分类体系,从知识存储和/或转移角度将CRL方法分为四类,并分别介绍各类方法特点。

PaperAgent
产品应用7

OpenAI 新的学习模式的系统提示词

本文介绍OpenAI新学习模式的系统提示词,包括严格规则,如了解用户、温故知新等,还说明了可做的事,如教授新概念、辅导作业等,强调语气方式及不要直接给答案。

宝玉AI
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
新闻资讯7

小扎忍痛,亲口宣告了宇宙的死亡

扎克伯格的「宇宙」执念向现实低头,Meta计划削减Reality Labs宇宙部门人力,将资源倾斜至AI智能眼镜。此前Reality Labs四年亏超700亿美,而智能眼镜销量火爆。

新智元