「顶尖科学家榜单」共找到 851 篇相关文章
BRIGHT榜单SOTA!人大&百度ReasonRank:用推理增强的段落重排序器
传统listwise在复杂查询表现差,近期工作泛化性不佳。人大与百度等提出ReasonRank,通过全自动合成13K推理数据及两阶段训练,在BRIGHT等榜单表现优异,且ReasonRank-7B比Rank1-7B快2.5倍。
告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜
DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态大模型集成,提升推理能力,实验效果显著。
数学圈地震!o3靠直觉刷爆人类顶尖难题,14位专家集体破防
Epoch AI新研究发现,o3 - mini - high能破解顶尖数学难题,具备渊博学识且会基于直觉解题,但推理风格依赖直觉,缺乏严谨性和创造力,还存在投机取巧、幻觉等问题。
四大顶尖模型对决!6000 字测评带你看Deepseek R1有多强
昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。
AI长身体,直接做实验!自主通用科学家,科研界的Scaling Law来了
本文探讨未来科研范式「自主通用科学家」(AGS),它将AI与机器人技术结合实现科研全流程自动化,有望突破人类科研限制,引发科学范式变革,还介绍了相关架构、优势及面临的挑战和应对策略。
顶尖数学家含泪退圈:熬了多年的博士难题,被AI几周秒杀!
顶尖数学学者Rishikesh Gajjala靠AI攻破博士课题,却宣布退出学术圈。他认为AI生成证明虽精巧但难验证,“漂亮证明未验证和垃圾无异”。他投身形式化验证领域,而AxiomProver完成“246定理”形式化验证。
登上 GitHub 日榜 TOP5,收获 1.2 万标星的自动剪辑视频开源工具。
video-use是browser-use团队开源的自动剪视频项目,登上GitHub日榜TOP5、获1.2万标星。它改变剪辑交互方式,让用户描述意图,有智能剪辑、调色等功能。技术亮点是双层读取系统,成本和效率更优。
小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听
小米官宣MiMo-V2家族三款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。
4000万样本炼出AI读心术,刷新七榜SOTA,最强「人类偏好感应器」开源
Skywork-Reward-V2全新发布,构建超高质量千万级人类偏好样本,刷新七大评测基准SOTA。8款模型覆盖6亿至80亿参数,小体积也能媲美大模型性能。团队引入多样大规模真实人类偏好数据,提升数据规模与质量。
科学家要失业了?GPT-5仅用18分钟解出黑洞方程,效率碾压人类数月!
2026年AI成科学家新战友,从破解优化难题到重现黑洞对称性,加速科学发现。数学家与ChatGPT合作完成证明,物理学者用GPT-5 Pro快速解黑洞方程,OpenAI还助力攻克生物学难题。