元认知自我修改」共找到 712 篇相关文章

算法论文8

EMNLP2025 | LLM多次回答一致就一定正确吗?非也

随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。

深度学习自然语言处理
开源动态8

ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana

ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。

量子位
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。

AINLPer
算法论文8

机器人需求驱动导航新SOTA,成功率提升15%!浙大&vivo联手打造

浙江大学和vivo人工智能实验室团队在ACM MM 2025发表新框架CogDDN。它模拟人类认知,将“双过程理论”用于机器人需求驱动导航,实验中表现优于单视角SOTA方法,为智能机器人技术发展奠基。

量子位
算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
开源动态7

AutoDev Remote 编程智能体:你何必只让 AI 在白天分析需求、设计方案

AutoDev Remote Agent 作为 AutoDev Workbench 一部分进入试运行,可运行在服务器,辅助项目分析规划、编写代码等。它是开源方案,代码可自由发布修改,还介绍了选择它而非 IDE 的原因及未来计划。

phodal
算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新零数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
新闻资讯8

GPT-5.6曝光了!OpenAI砸钱宣战:换掉Claude Code

GPT-5.5发布三周,GPT-5.6曝光且进入开发全速阶段,预计下月亮相。OpenAI本周四将上线「ultrafast模式」,速度提升2 - 3倍。Codex与Claude Code全面开战,OpenAI砸钱吸引开发者,AI自我加速与商业化形成正反馈。

新智元
算法论文8

刚刚!UCLA杨林团队证明:仅凭提示词,Gemini 2.5 Pro就可以拿到IMO2025金牌

加州大学洛杉矶分校杨林和黄溢辰撰写论文,阐述利用Gemini 2.5 Pro解决2025年IMO竞赛5道题达金牌水平。设计解题者和验证者构成的自我验证流水线,用双提示词系统迭代,还规避数据污染问题。

AI寒武纪
新闻资讯7

拒掉字节、谷歌橄榄枝,Meta 离职大佬田渊栋官宣自立门户!苏妈老黄追着投

Meta离职大佬田渊栋官宣创业,新公司Recursive Superintelligence首轮融资6.5亿美元,估值46.5亿美元。其团队豪华,想跳出大模型竞争老路,让AI具备自我进化能力,计划2026年中期推出自主训练系统。

InfoQ