天问大模型」共找到 8083 篇相关文章

算法论文8

一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%

北京航空航大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与可扩展性。

量子位
推荐文章7

国庆这8,我发现和AI辩论才是最高效的学习方式。

作者国庆假期与AI辩论,以自身关于AI时代信息筛选的观点为例,阐述和AI辩论是高效学习方式。先提出观点,后与AI多轮交锋,过程虽痛苦但能促使人思考、完善观点,还给出与AI辩论三步法。

数字生命卡兹克
算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
新闻资讯8

OpenAI首个蛋白质模型披露更多细节,改进诺奖研究成果,表达量提升50倍

OpenAI与Retro Bio合作开发的GPT‑4b micro,是专为蛋白质工程设计的GPT-4o微型版本。它改进诺奖获奖蛋白变体,将干细胞重编程标记物表达量提升50倍,还能减少DNA损伤,研究团队公布更多突破细节。

量子位
新闻资讯8

Demis Hassabis揭秘世界模型Genie 3的真正意义:为AGI打造无限“虚拟子宫”

Google DeepMind CEO Demis Hassabis与产品负责人深度对谈,爆料将游戏智能体SIMA放入Genie 3生成世界训练,探讨AI从游戏到思考系统的演进、Genie 3意义及AGI评估挑战,还提及与Kaggle合作推游戏竞技场。

AI寒武纪
新闻资讯7

4比0横扫Grok 4,o3强势夺冠,首届大模型对抗赛结果出炉

备受AI圈关注的首届谷歌Kaggle AI Chess大赛落幕。o3以4 - 0横扫Grok 4夺冠,Gemini 2.5 Pro 3.5 - 0.5击败o4 - mini获季军。此前Grok 4被视为夺冠热门,决赛却频频失误。

机器之心
算法论文8

感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节题,在多基准测试中表现优,但有KL_prcp Hacking现象。

量子位
推荐文章7

AI大模型浪潮下的认知重构:从一个数据老兵的转型思考

作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模及 AI 原生产品变化。

InfoQ
新闻资讯8

清华给电子显微镜加上Agent,DeepSeek V3全程调度,数流程缩短至几分钟

清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。

量子位
算法论文8

纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究

剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。

量子位