「经验驱动训练」共找到 3135 篇相关文章
AGI前夜重磅:RL突破模型「认知上限」,真·学习发生了!
AI研究圈争论RL能否赋予模型超越基础模型的推理能力。UC Berkeley等团队提出DELTA框架,观察到“RL grokking”现象,还设计新任务验证,提出两阶段奖励调度,总结两种模式等,为争论带来新依据。
昂瑞微IPO:以战略定力穿越周期,构建射频前端国产化新范式
在全球半导体行业波动与技术创新背景下,昂瑞微IPO受关注。它技术攻坚突破L - PAMiD,构建‘双轮驱动’,布局车载与卫星通信新赛道,以战略定力穿越周期,为国产芯片发展注入活力。
承认自己开源不行?转型“美国DeepSeek”后,两个谷歌研究员的AI初创公司融到20亿美元,估值暴涨15倍!
AI创业公司Reflection AI由两位前Google DeepMind研究员创立,一年完成20亿美元融资,估值达80亿美元。它从编码智能体起步,现转型为开源替代公司,主打“开源”牌,计划明年推前沿语言模型。
ImageNet作者苏昊被曝任教复旦
ImageNet作者之一苏昊被曝要去复旦任教。他是具身智能领域论文被引次数最高的华人学者,主导多个奠基级项目。他研究从语言到2D、3D视觉,再到机器人,还创办具身智能公司Hillbot。
阿里亲身入局具身智能!Qwen内部组团,通义千问技术负责人带队
阿里Qwen团队组建具身智能小分队,由通义千问技术负责人林俊旸带队。外媒称这是阿里最明确的物理AI系统探索,此前阿里已有投资布局,此次是其AI战略关键落点。
一个让 AI 智能体(AI Agent)工作更出色的绝妙方法,简单到令人惊讶:只要给它们设定一个人格
论文揭示无需复杂重新训练就能引导AI行为,提出MBTI-in-Thoughts框架,在提示词里让大语言模型扮演特定MBTI人格,其行为会改变,还经测试验证,有广泛应用前景。
GPT-5都救不了的AI幻觉,原来问题不在模型,在“考卷”
OpenAI研究指出AI产生幻觉的根本原因是评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。
阿里王牌Agent横扫SOTA,全栈开源力压OpenAI!博士级难题一键搞定
阿里昨晚开源通义DeepResearch,在多项权威基准上表现出色,超越OpenAI、DeepSeek。模型、框架、方案全开源,开发者可在相关平台下载。它告别一问一答模式,像研究员一样工作,还构建了独特数据体系。
超越 Prompt 和 RAG,「上下文工程」成了 Agent 核心胜负手
本文称「上下文工程」成 Agent 核心胜负手,它指在正确时间为 Agent 提供正确信息,超越 Prompt 和 RAG。文章归纳五大策略,如转移、压缩等,并结合 *The Bitter Lesson* 启示,探讨构建面向未来的 AI Agent。
超越90%城市规划师!清华、MIT等提出人机协作新范式 | Nature子刊
清华大学联手MIT等机构提出「大语言模型+规划师」新框架,让AI作「智能规划助手」。框架含概念设计、方案生成、效果评估三阶段,实验显示AI表现超九成人类规划师,未来将人机协同。