自我一致错误」共找到 530 篇相关文章

算法论文8

Test Time Scaling Law远未达到上限! o4-mini仅15.8%通过率,华为诺亚提出代码HLCE终极基准

华为诺亚研究员推出全新编程基准HLCE,含235道竞赛难题。实验显示,顶级LLM在该基准表现不佳,推理模型优势大,IOI交互式题难攻克。研究还发现模型自我认知与推理能力发展不同步,Test Time Scaling Law远未达上限。

机器之心
新闻资讯7

一种用于管理 AI 变革步伐的演进式架构模式

Cloudflare推出基于QuePaxa共识算法的Meerkat服务,可无领导者写入并保持强一致性,提高网络可用性。它预计将是QuePaxa全球首次生产部署,但存在局限性,如大量往返通信。

InfoQ
新闻资讯7

「重置之神」Tibo:Codex真的有一个「重置」按钮,实体的

OpenAI Codex产品负责人Tibo在播客透露重置按钮是实体。他谈了OpenAI文化、给创业者建议,还涉及AI开发流程、ChatGPT与Codex合并、额度重置原因等多方面内容。

机器之心
产品应用7

复制这套神仙配置,让Claude Code全自动修Bug!告别每天重复教AI写代码

Claude写代码常犯重复错误,根源是无跨会话记忆。Claude code创始人Boris Cherny爆料团队让Claude自纠错,并分享配置让其自动发现、修复错误且不再重犯,介绍各步骤及完整配置和前后对比。

AI寒武纪
产品应用7

全新唇同步技术OmniSync,遮挡,侧脸不在话下

唇同步对创建逼真视频内容很重要,但现有方法在身份一致、姿势变化等方面有局限。中国人大携手快手提出OmniSync,引入无需掩膜的训练范式,保证身份和姿态一致,能适应复杂场景,还建立AIGC - LipSync基准。

带你学AI
产品应用8

迎接智能体的「觉醒时刻」:EverOS全球公测开启Agent Memory自进化序章

随着主动执行型 Agent 爆发,AI 向自我演化智能体跃迁,但现有 Agent 有诸多痛点。EverMind 团队公测专为自我演化智能体设计的记忆底座 EverOS,它依托核心算法与进化引擎,提升任务成功率,解决多项技术难题。

机器之心
新闻资讯8

AI上清北,普通人该怎么办?|甲子光年

2025年AI模拟高考成绩达清北线,引发对人类努力意义的思考。三位嘉宾围绕AI能力进步、与人类能力差异、对教育和创作的影响等展开对谈,探讨人类在AI时代的定位、专业选择、教育变革等问题。

甲子光年
算法论文7

SceneWeaver:面向通用三维环境生成的反思型智能体框架

室内场景合成在具身智能兴起下愈发重要,现有方法存在局限。BIGAI提出SceneWeaver框架,通过基于工具的迭代优化统一多样场景合成范式,具有高保真模拟、强健物理交互等优势。

带你学AI
新闻资讯7

UW天才少女官宣入职OpenAI!46场面试,地狱级求职笔记刷屏

华盛顿大学华裔女博士Alisa Liu为入职OpenAI经历57轮面试,事后公开面试准备笔记成“LLMs面试圣经”。她分享求职经验,如合理安排面试、刷题备考、每场面试专门准备、学会薪资谈判等。

新智元
开源动态7

DeepSeek Harness和V4 Pro正式版同时重磅上线,一手实测:DSH更像是AI操作系统

DeepSeek V4 Pro正式版0813上线,升级Agent能力,网页、API、app皆可用。DeepSeek Harness亮相并开源,基于“一切皆插件”理念。V4 Pro跑分部分能力突出但价格将涨,其实际表现待更多测试。

AI寒武纪