「数学语言」共找到 1409 篇相关文章
半世纪难题48小时破解!陶哲轩组队把AI数学玩成打怪游戏了
陶哲轩与多名数学家合作,借助多种AI工具,仅用48小时就解决了尘封50年的Erdős问题。此次解题既有“人与人的协作”,也有“人与AI的协作”,这种方式正成新趋势。
GPT-5通过“哥德尔测试”!独创性解决博士生都得花几天时间的开放数学问题
最新论文中,研究人员让GPT - 5挑战5个未解决的优化猜想,它解出3个,还对一题给出不同有效证明方案。测试题需博士水平研究者花几天完成,研究还“挑衅”了陶哲轩对大模型数学能力的印象。
舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿
本文介绍新加坡国立大学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。
陶哲轩看傻:三破18年数学纪录!谷歌推出「AI爱迪生」,科研不再靠灵感?
5月中旬谷歌发布AlphaEvolve,30天攻克18年未解难题。它利用Gemini模型发现新算法,从AlphaGo获启发,能在编程空间搜索方案,或开启不靠‘灵感’的科学革命,还将改变科学家角色。
10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题
推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。
LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了
华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。
对话微软研究员华文越:横跨数学、哲学与计算机,她如何重构 Agent 的信任基石?
本期访谈邀微软研究员华文越跳出技术视角,探讨如何用跨学科思维解决Agent落地难题,如找模型等间最优解、建信任标准,还将深入其工作逻辑及对Agent未来思考。4月18日直播。
MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新
生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。
AI 找到了六个 Erdos 数学问题,陶哲轩:AI + 人类专家才是真正改变科学研究的方式
菲尔兹奖得主陶哲轩分享,AI 在 Erdos 问题网站实验中,帮数学家发现六个原本标记为「未解决」的问题其实已被解决。他认为 AI 有价值的应用是处理枯燥日常工作,如文献搜索。
ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术
清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。