数学顶刊」共找到 821 篇相关文章

算法论文8

清华&通院推出"绝对零"训练法,零外部据大模型自我博弈解锁推理能力

清华、北通院和宾州州立大研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与推理表现。

量子位
新闻资讯8

GPT-6发布,OpenAI说AGI时代来了

北京时间9月4日凌晨,OpenAI发布GPT - 6 Astra,虽发布过程狼狈,但该模型在多项评测中表现出色,如评测、电脑操控等,但编程类任务未全面领先,且网络安全方面部分功能被限制。

花叔
推荐文章7

完全相信 AI 代码的 Uncle Bob,坦诚这条路还没走通

在AI代码普及当下,Uncle Bob放弃人工评审代码,搭建管控框架引争议,Grady Booch反对,认为AI无法替代资深工程师。Uncle Bob设强约束体系,虽有成效但自动化架构规划未达理想,还给出开发建议。

AI前线
开源动态7

爆火的 DeepSeek Harness,全网最全小白接入教程!

DeepSeek Harness 在 GitHub 上线不到三天 Star 破 10 万。文章给出小白接入教程,介绍三种部署思路,包括手动安装、用 Agent 一键安装、一键安装桌面版,还给出其与多个框架的测评对比。

特工宇宙
推荐文章7

Coding Agent 在百度的落地实践:从反馈闭环到工程范式重构

本文整理自百度文心快码研发经理牛万鹏演讲,介绍了Coding Agent在百度的落地实践。包括落地成效、Agent Loop框架问题、Feedback Loop构建、Benchmark评测及Agent Engineers理念,还提及企业级Agent落地的工程问题。

InfoQ
算法论文8

RAG搜对了却答错?德国萨尔大找到了真相丨ACL'26

RAG已成大模型落地标配技术,但存在搜到对的文档、模型答案却离谱的痛点。德国萨尔大等组成的团队诊断出问题在阅读理解,提出Disco - RAG框架,在“搜”和“答”间加“读懂”环节,已被ACL 2026主会录用。

量子位
开源动态8

年轻人的第一个爱马仕

AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星超35000。作者写76页《Hermes Agent从入门到精通》,介绍其设计思路、使用方法等,中英文版可在GitHub免费下载。

花叔
新闻资讯7

刚刚,NeurIPS退让了

AI会NeurIPS发布长推文,就编制2026手册时错误加入美国政府制裁工具链接一事解释、道歉并承诺。但网友不买账,中国科协也停止受理参会资助申请,术社区信任受损难弥合。

机器之心
新闻资讯8

它石智航用“吉尼斯纪录”交卷真干活的具身大脑,丁文超:从来没有Plan B

它石智航在获巨额融资后埋头研发,其A1机器人创线束装配吉尼斯世界纪录。该公司打造具身大脑AWE 3.0,还推出SenseHub采套件,发起具身据星火计划,推动具身智能发展。

量子位
算法论文8

大模型会拖进度条看视频了!阿里新研究让视频推理告别脑补,实现证据链思考 | ICLR 2026

阿里巴巴未来生活实验室团队解决多模态大模型视频推理难题,推出ReWatch据集和ReWatch - R1模型。据集克服现有训练据痛点,模型用SFT + RL范式及创新奖励机制,实验成绩SOTA。

量子位