元认知自我修改」共找到 712 篇相关文章

算法论文8

大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。

量子位
新闻资讯8

AI Spot 学术分享会丨ICLR 2026 深度推理专场

当大模型走向深度推理,ICLR 2026 汇聚全球顶尖成果。OpenMMLab 等联合发起 AI Spot ICLR 2026 学术分享会,5 月 14 日 19 点直播,聚焦模型‘慢思考’,嘉宾将解读四大核心技术。

OpenMMLab
算法论文8

合成数据≠生成模型:一文读懂合成数据的全新范式

最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
推荐文章7

鹅厂员工怎么看Agent自动持续进化?

落地一个Agent容易,但让其自动持续优化很难。文章分享了9位鹅厂同事对“Agent如何自动持续进化”的看法,如建立评估体系、记录真实任务反馈、结合强化学习等。

腾讯技术工程
算法论文8

钉钉DeepResearch, 0.008元/1k Token击穿地板价

阿里为7.5亿钉钉用户推出Dingtalk - DeepResearch,解决企业办公AI化痛点。系统采用“三横一纵”架构,有多阶段强化学习等三种解法及DingAutoEvaluator纵向飞轮,实现模型自进化、自纠错。

CourseAI
产品应用7

Kimi K2:唯一能稳定准确生成时钟的AI模型

AI World Clocks项目让9个大模型按提示词生成每分钟更新的时钟,以观察稳定性。国产Kimi K2是唯一能稳定保持表盘与指针正确平滑转动的模型,测试显示了模型在时空概念上的能力差异。

AI工程化
开源动态8

谷歌开源新Deep Research范式,教Agent学会真正的思考。

周末谷歌发博客讲Deep Research,它重新定义一些Agent常见范式。现在多数Agent模式缺全局观,谷歌让AI先打草稿再迭代修正。新框架含技巧,在多任务上超OpenAI,已可试用。

探索AGI
产品应用8

全球首款AI原生UGC游戏引擎诞生!输入文字秒建GTA世界,试玩体验来了

全球首个由实时世界模型驱动的AI原生游戏引擎Mirage问世,玩家能实时构思、生成并体验游戏世界。虽当前体验有不足,但它有显著优势,支持多元游戏类型,基于前沿技术构建。

机器之心
推荐文章8

机器人为什么要拟人?终于有人正确回答了

今年6月,英伟达发布Isaac GR00T人形机器人参考平台,深度机智发布论文Human - as - Humanoid。具身智能瓶颈是数据,深度机智以人类学习范式破局,完成全栈技术闭环,领先优势扩大。

机器之心
产品应用7

大神卡帕西又一构想落地!Claude Code + Obsidian 爆火:创建你的「第二大脑」

2026年4月,Andrej Karpathy提出LLM Wiki,将LLM使用范式推向「知识生产系统」。6月27日,RGK用Claude Code + Obsidian构建“第二大脑系统”,解决记忆、上下文、执行问题,还引入反馈机制、优化Token成本。

AI科技评论