专家质疑」共找到 792 篇相关文章

新闻资讯7

谁杀死了那篇好论文?AI顶会乱象:好文被刷,低分论文捧上天

一位AAAI 2026审稿人在Reddit匿名爆料,称评审流程乱象丛生,好论文被拒、弱论文晋级,还有疑似“关系稿”。AAAI启用AI辅助审稿系统,本意提升效率,却让评审更不可控,侵蚀学术信任。

新智元
新闻资讯7

Codex 积分制计费上线,Claude Code 急了……

OpenAI Developers宣布Codex推出积分制度,重置速率限制,ChatGPT Plus和Pro用户可买积分获额外使用量,每1000积分40美元。云端任务将计入速率限制,社区反应不一,且积分会过期,Claude Code为挽回用户送会员。

AGI Hunt
算法论文8

谷歌发布首个AI+教育RCT实验,传统教材要凉?

谷歌论文提出Learn Your Way AI增强型教科书系统,有两阶段AI生成框架,构建完整学习体验。经专家评审和RCT证明,使用该系统的学生学习效果和体验更好,还介绍了其可用场景。

CourseAI
产品应用8

AI如何重塑大厂成熟业务?百度文库GenFlow打了个样

文章讲述百度文库借助AI从“资源下载站”变为“智能生产力平台”。其转型体现在产品定位重构、挖掘用户需求、跨业务协同。GenFlow2.0打通文库与网盘,提升体验、重塑边界,证明非核心业务也能价值重生。

乱翻书
算法论文8

英伟达的AI已经开始接管整个项目了?SATLUTION自主进化代码库登顶SAT竞赛

NVIDIA Research提出SATLUTION框架,将LLM代码进化能力扩展到完整代码库规模,能处理复杂项目。它协调LLM智能体对SAT求解器代码库迭代优化,在SAT竞赛中超越人类冠军,成本低且效率高。

机器之心
新闻资讯7

The Batch: 866|GPT-5 起飞遇乱流

OpenAI推出GPT - 5及其系列模型,涵盖多种类型,有新功能与性能提升。但发布中路由器故障等问题让用户失望。它在部分基准测试表现佳,不过抽象推理能力有不足,还回顾了发布历程。

DeeplearningAI
推荐文章8

Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂

Data Agent 看似易上手,落地却充满挑战。腾讯数据工程专家虎兴龙指出,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略相关要点,投入或打水漂,掌握关键要素可提升数据智能化效率。

InfoQ
算法论文8

推理路径的动态调控:让大模型学会“恰到好处”的思考

当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
算法论文8

开放世界任务成功率82%!美的攻克机器人泛化控制难题

美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。

量子位
7

苹果一口咬死AI不会思考!OpenAI前高管直接开怼:AGI已来,别再酸了

苹果论文《思考的错觉》挑战AI推理能力基本假设,引发争议。OpenAI前研究主管则称AGI时代已近。多项研究测试推理模型,指出其有进步也有瓶颈,未来或需换思路,评估方式也待完善。

新智元