中科大」共找到 6878 篇相关文章

算法论文8

CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?

论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。

深度学习自然语言处理
算法论文8

谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型

谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。

新智元
算法论文8

6666!NuerIPS满分论文来了

NuerIPS唯一满分论文结论惊人,指出真正决定推理上限的是基座模型本身而非强化学习,且蒸馏比强化学习更有望实现模型自我进化,这给正火热的RLVR泼了冷水。

量子位
算法论文8

斯坦福新论文:微调已死,自主上下文当立

斯坦福学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,在多场景测试表现优于多种方法。

量子位
新闻资讯7

OpenAI首席学家访谈被紧急制止!有些名字现在不让说了……

OpenAI首席学家访谈时被要求禁止透露重要员工名字,因Meta常挖人。GPT - 5将发布,奥特曼谨慎应对。此外,还介绍了OpenAI研究方向、瓶颈,以及其他公司在挖人的举措。

量子位
开源动态7

Distilabel DeepSeek-R1 模型蒸馏教程

文章介绍结合distilabel与QLoRA技术定制专属模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。

机器学习AI算法工程
新闻资讯7

OpenAI 离职员工爆料公司压力巨发展速度惊人

前OpenAI员工Calvin回顾工作经历,称其发展极快、压力。公司依赖Slack沟通,自下而上创新,重能力而非政治。还提到技术栈、安全关注重点等,认为OpenAI、Anthropic和Google是AGI赛道主力。

MacTalk
新闻资讯8

陶哲轩痛诉很缺钱!研经费暴跌67%十年最低,自掏腰包

美国国家学基金会削减基础学资助,数学学领域资助降。菲尔兹奖得主陶哲轩痛诉经费不足,自掏腰包做研,还以“开普勒的橙子”说明基础研究虽短期无用,却能助力技突破。

新智元
新闻资讯7

突发!Gemini 3.8登顶,谷歌迈出RSI一

谷歌发布Gemini 3.8 Flash及专攻网络安全的3.8 Flash Cyber。前者性价比高,在多项测试逼近顶级模型;后者在网络安全测试屠榜。但谷歌也被指提前庆祝,且模型可能有‘刷榜’成分。

新智元
算法论文8

ICML 2026获奖论文揭晓:黄高团队获杰出论文,A3C算法获时间检验奖

ICML 2026公布最佳论文奖项,共10篇获奖,涵盖杰出论文奖、杰出立场论文奖等。此次评选严格,经多轮筛选。获奖论文涉及扩散式语言模型、扩散模型采样算法等多个领域。

机器之心