「认知下降」共找到 460 篇相关文章
合成数据≠生成模型:一文读懂合成数据的全新范式
最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。
RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘
近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。
鹅厂员工怎么看Agent自动持续进化?
落地一个Agent容易,但让其自动持续优化很难。文章分享了9位鹅厂同事对“Agent如何自动持续进化”的看法,如建立评估体系、记录真实任务反馈、结合强化学习等。
不写、不看、不审查:这家安全公司决定不再让人类碰代码,还把这套模式开源了
2026年2月,安全公司StrongDM公开“软件黑灯工厂”式生产线成果,人类不直接写代码和审查,由Agent自动生成。该模式开源,虽有开发者指出问题,但获学界认可,不过面临成本高的现实问题。
OpenAI不Open!7年功勋老将投奔宿敌,实验室沦为API代工厂
2026开年,OpenAI的「推理之父」Jerry Tworek离职,他入职近七年,是推理技术核心人物。Scaling Laws失效,后训练成主要出路,但深度推理成本高,在强调盈利环境下,Tworek不满研究受限而离开,OpenAI或失去通往AGI的机会。
Deepseek是被降智了吗?
作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。
Kimi K2:唯一能稳定准确生成时钟的AI模型
AI World Clocks项目让9个大模型按提示词生成每分钟更新的时钟,以观察稳定性。国产Kimi K2是唯一能稳定保持表盘与指针正确平滑转动的模型,测试显示了模型在时空概念上的能力差异。
机器人为什么要拟人?终于有人正确回答了
今年6月,英伟达发布Isaac GR00T人形机器人参考平台,深度机智发布论文Human - as - Humanoid。具身智能瓶颈是数据,深度机智以人类学习范式破局,完成全栈技术闭环,领先优势扩大。
大神卡帕西又一构想落地!Claude Code + Obsidian 爆火:创建你的「第二大脑」
2026年4月,Andrej Karpathy提出LLM Wiki,将LLM使用范式推向「知识生产系统」。6月27日,RGK用Claude Code + Obsidian构建“第二大脑系统”,解决记忆、上下文、执行问题,还引入反馈机制、优化Token成本。
打破视觉Token的算力诅咒,RedundancyLens如何为多模态大模型推理减负
多模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。