「学术同行评审」共找到 248 篇相关文章
顶尖模型离“科学家”还差得远?AI4S亟待迈向2.0时代
《Nature》研究指出,过度依赖现有深度学习模型或阻碍创新。上海 AI 实验室周伯文提出,应推动科学智能从 AI4S 迈向 AGI4S,还介绍“智者”SAGE 架构、“书生”模型及平台等探索成果,并邀同行共拓蓝图。
AI「生肉证明」堆爆GitHub!陶哲轩重磅发声:只会解题没用了
陶哲轩判断数学从证明稀缺进入过剩时代,AI 使证明生成加速,出现验证和消化跟不上的‘阻抗失配’现象。如 Erdős 问题有众多待评估方案堆积,而仅1196号案例跑通‘三件套’。他还指出学术评价体系将重写。
斯坦福&英伟达提出新范式:推翻Scale Law,在“推理”阶段自我进化,超越人类专家
斯坦福和英伟达提出 TTT - Discover 新范式,允许模型在测试时继续训练,针对难题‘进化’。它设计了自适应熵目标函数和 PUCT 状态复用组件,实验在多领域碾压人类专家与同行,但在部分领域落地有局限且计算成本高。
GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3
新智元报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更多算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。
GPT-5.6攻克25年量子信息难题,人类学者连夜「像素级」洗稿发论文
7月23日,量子信息领域一道悬了25年的难题出现两份独立证明,一份由GPT - 5.6 Sol生成,另一份人类署名论文被质疑与GPT - 5.6 Sol输出相似且无AI使用声明。GPT - 5.6 Sol半月内已在多学科产出证明,引发学术署名规则讨论。
长生不老成真?哈佛AI数周破解「衰老密码」,人类寿命或迎重写
哈佛团队借助AI系统K-Dense揭示衰老分阶段运行的秘密。K-Dense采用层级多代理架构,能完整跑通研究流程,在BixBench测试中超越GPT - 5。它还让哈佛团队几周完成原本数年的研究,成果待同行评审。
在AI彻底接管科研之前,我们和三位人类科研工作者聊了聊
在AI重塑科研各环节的当下,DeepTalk邀请三位研究者探讨相关问题,包括AI科学家能力边界、论文价值变迁等。如朱熹指出AI目前知识多为先验,刘昊琨认为其缺‘科研品味’,还交流了论文传播、评审等看法。
一位工程师对“好代码”的 7 年思考
本文围绕“什么是好代码”展开,作者结合自身职业发展,从初入职场的“黑盒认知”到深入思考多维度评价标准。还介绍代码评审标准,从稳定、体验、效率、成本衡量。最后给出写好代码的方法和面临的挑战。
18岁天才少年,登上Nature封面!
DeepSeek-R1荣登Nature封面,成史上首个经严格同行评议大模型。18岁天才少年涂津豪以实习生身份参与,其从高中生到Nature作者的经历堪称传奇。他还改造Claude 3.5,开源项目获15k多星,还对AGI发表思考。
论文秒变PPT!西湖大学AGI Lab推出Auto-Slides,科研汇报难度骤降
西湖大学AGI Lab推出Auto - Slides,输入论文PDF可自动生成演示文稿,支持自然语言交互修改。它采用多智能体协作框架,经实验验证优势明显,有望用于学术会议等场景,助力知识传递。