「后训练课程」共找到 3829 篇相关文章
上海AI Lab提出CANON:让RLVR自主识别优质推理模式
上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。
Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」
Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。
澜起科技:高速互连芯片巨头历史
文章讲述澜起科技发展历程。它从电视机顶盒芯片转型内存接口、高速互连芯片,虽历经政策冲击、做空危机、供应链压力与客户竞争等挑战,但凭借技术实力和研发投入,在行业中站稳脚跟,未来有望受益于AI算力需求升级。
从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」
新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。
李飞飞一年前究竟说了啥?怎么又火了
AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。
OpenAI/微软争夺AGI控制权!重组谈判激烈,年底谈不成软银700亿或撤
OpenAI与微软就重组问题谈判胶着,核心在控制权与确定性,如多云是否松口、微软能否获取训练细节、AGI条款去留。这影响微软持股价值和软银投资,年底是关键节点,若重组未完成,软银或撤回100亿美元。
Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra新范式
文章指出Agent成AI主流叙事,但企业部署后效果不佳,因未认识到Agent平台无法单独构成AI Infra。强调数据是AI Infra核心,提出Data&AI数据基础设施是新范式,还分析赛道玩家并介绍科杰科技的实践。
涌现之谜:AI如何像人一样思考与表达?
文章探讨AI如何像人一样思考与表达。早期自然语言处理受通用语法理论影响,但面对真实语言复杂性存在困难。人类经历第一次认知革命实现思维转变,AI也需足够大规模才能涌现复杂能力,“大”或是智能第一性原理。
Google AI搜索革命的代价:网站流量暴跌一半,内容创作者哭了
皮尤研究中心报告显示,Google的AI概览功能使网站点击率狂跌近50%,其扩张速度惊人。用户看到AI概览后倾向直接结束搜索,内容创作者流量和收入锐减。Google回应称研究数据有问题,且AI还存在幻觉隐患。
Grok火爆全球,靠的居然是一个二次元金发美少女。
马斯克推出Grok的companion功能,3D虚拟人Ani是二次元金发美少女。功能上线后Grok热度大增,下载量在日本和中国香港冲到第一。Ani有好感度系统,能换衣服,还可聊NSFW内容,引发用户兴趣。