「学习场景」共找到 3192 篇相关文章
Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题
OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。
2025 AI Agent全景报告:50+权威数据,85%企业已上车、发展趋势预测!
index.dev发布AI Agent调研报告,盘点50多个关键数据,涵盖应用趋势、场景、工作流等。截至2025年,85%组织集成AI Agent,市场价值73.8亿美元,预计2032年达1036亿美元。报告还分析技术栈各层应用及市场趋势。
Agent 都这么厉害了,「AI 员工」为什么今天还没有真正出现?
AI员工呼声高却未落地,瓶颈可从其源起探寻。早期自动化工具非真正数字员工,大模型带来新可能,但存在时效性、场景定义、意图澄清、知识更新、博弈能力等问题,未来建议局部替代,先以实习生角色上岗。
软件行业“快时尚化”背后的经济学 | AGIX PM Notes
本周市场对软件看法悲观,OpenAI CEO 警告软件或进入‘快时尚时代’。但软件行业会升维,一是从‘死’变‘活’,具备元学习能力;二是定价更极致。还介绍了本周市场总结及多起 AI 相关企业动态。
对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds
本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆多为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。
复盘 ChatGPT:7 亿周活的 ToC 产品,如何在模型之外做增长?
Lenny播客邀请OpenAI的ChatGPT负责人Nick Turley对谈,他分享了ChatGPT从内部项目成长为7亿周活产品的过程,包括产品开发、增长、定价决策等,还阐述了成功原因、增长方法等,为AI创业者带来启发。
DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO
文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。
全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四
Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。
独家 | 腾讯X Lab 韩磊即将离职,将加入诺亦腾科技
AI 科技评论独家获悉,腾讯具身智能技术中心副总经理韩磊 7 月底离职,将加入诺亦腾科技。韩磊在多智能体强化学习成果多,其参与研究登上《Nature Machine Intelligence》2024 封面,加入诺因该司有大量动捕数据。
「Next-Token」范式改变!刚刚,强化学习预训练来了
微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。