「元学习」共找到 1996 篇相关文章
首钢园“产业跃升俱乐部”首秀:从WANOS全景声到波萝元宇宙
首钢园“产业跃升俱乐部”首期轮值活动“从WANOS全景声到波萝元宇宙”成功举办,标志开启月度轮值新机制。活动汇聚各方精英,探索创新驱动产业跃升路径,展示波萝元宇宙成果,还围绕技术与投资议题讨论。
Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」
Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。
狂揽16.1k星!清华开源交互式AI课堂,学霸打造的最懂学习的AI工具
清华开源的OpenMAIC是多智能体互动课堂平台,能将文档转化为互动学习场景,自动生成课件等内容,有五种交互式界面、AI教师指导,可在任何设备使用,对教育场景很有价值。
腾讯混元发布并开源图像模型 2.1,支持原生 2K 生图
9月9日深夜,腾讯发布并开源混元生图模型“混元图像2.1”,支持原生2K高清生图,综合能力领先。它在多方面升级,有诸多亮点,评估显示效果优,还同步开源文本改写模型,能满足多样视觉需求。
新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型
Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。
人工智能提出七十载!从百度CTO到NVIDIA副总裁,十年共启ASI新智元
今年是人工智能提出七十周年,新智元十周年峰会9月7日将在北京举行,届时发布《2025新智元ASI前沿趋势报告》。峰会集结百度CTO、NVIDIA副总裁等十位领航者,以‘十人十题’解构AI五阶段路线图,纵览AI发展图景。
大模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点
加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。
Meta元宇宙部门狂裁千人:一醒来就收到邮件,刚入职也未能幸免
彭博社消息,Meta调整元宇宙业务,大规模裁撤Reality Labs超1000岗位。此前已确认削减元宇宙资源投入,省下资源用于AI硬件等。此次裁员是因该部门亏损超700亿,Meta战略转向AI。
阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒
4月27日,阿里巴巴视频生成模型HappyHorse 1.0开启灰测,全球专业创作者和企业级客户可在官网和阿里云百炼平台注册使用,大众用户可在千问App体验。官网720P视频生成刊例价0.9元/秒,专业会员包月叠加限时折扣后低至0.44元/秒。
语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约
现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。