「在线后训练」共找到 3842 篇相关文章
突发|Andrej Karpathy官宣加入Anthropic!
周二晚间,Andrej Karpathy在X上自宣加入Anthropic,将在核心预训练团队工作。他是AI领域极具影响力人物,曾任职OpenAI、特斯拉等。此次加入或助推Anthropic上市,也让OpenAI面临压力,或引发新一轮AI军备竞赛。
DeepSeek招聘被「华为天才少年」公开吐槽,“面到最不专业的”
前华为天才少年李博杰公开吐槽DeepSeek招聘不专业,包括笔试后久不安排面试、面试官迟到态度轻佻、质疑其作弊等。今年DeepSeek大规模扩张,招聘要求高,但面试资源或难跟上。
拒掉字节、谷歌橄榄枝,Meta 离职大佬田渊栋官宣自立门户!苏妈老黄追着投
Meta离职大佬田渊栋官宣创业,新公司Recursive Superintelligence首轮融资6.5亿美元,估值46.5亿美元。其团队豪华,想跳出大模型竞争老路,让AI具备自我进化能力,计划2026年中期推出自主训练系统。
别求Claude了!搭子DuMate杀疯,国产Cowork已帮你把活干完了
Anthropic更新Claude帮助中心,对部分用户启用身份验证,让国内重度用户焦虑。百度智能云上线搭子DuMate,它是桌面级AI智能体,能自动化办公,还更懂国内工作场景,上线后高频迭代。
太反差了!那边Claude强制「刷脸」认证,这边国内Coding Plan被外国人疯抢
Anthropic要求Claude用户进行严格身份验证,被网友吐槽。而国产GLM Coding Plan因模型能力提升在海外走红,海外版涨价后,海外开发者研究买中国版,国内购买也很火爆,闲鱼还出现代抢生意。
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力
来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。
无需奖励函数!我们意外构建了自我进化的AI系统
牛津大学发现LLM可通过“部署 - 验证 - 再训练”循环自我进化,绕开人工奖励函数设计瓶颈。在三个经典规划领域实验效果惊人,还在理论上证明其与强化学习的数学等价关系,有优势也有隐患。
LeCun预言成真!790年长视频,炼出最强开源「世界模型」
2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。
LeetCode刷够100小时,学会找人内推,OpenAI员工下场教你拿Offer
OpenAI新研究员Bas van Opheusden分享长达8页的面试指南,涵盖心态调适、准备策略、编程技巧等方面。他强调身心健康、享受过程,给出准备时间建议,还介绍各面试环节技巧及通过后注意事项。