新范式」共找到 4045 篇相关文章

算法论文8

DeepSeek开源大模型记忆模块!梁文锋署名论文,下一代稀疏模型提前剧透

DeepSeek最论文给Transformer加上“条件记忆”,补上原生知识查找机制。梁文锋署名,与北大团队合作。提出全新范式及Engram模块,解决传统N - gram问题,研究稀疏性分配,验证推理能力提升,兼顾工程优化。

量子位
8

刚刚,OpenAI神秘模型斩获IMO 2025金牌!攻克奥数巅峰,硅谷沸腾

OpenAI用全通用推理模型夺下IMO 2025金牌,解出5道题狂揽35分,远超此前Gemini 2.5 Pro的13分。此或意味着其研发出颠覆性推理技术,告别CoT,且模型未针对IMO训练,有持久创造性思维。

新智元
算法论文8

NeurIPS 25 | GRPO进阶版来了,GVPO重构大模型后训练范式

大模型后训练越发关键,GRPO 有缺陷。作业帮与香港科技大学(广州)团队在 NeurIPS 2025 提出 GVPO 方法,解决 GRPO 稳定性难题,理论有最优解保证,实验表现超现有方法。

机器之心
6

九月站比赛结果出炉,第一名网站上线当月拿下217K的PV。

社群里的明星朋友Clara通过参加站比赛,副业收入已超工资,即将全职独立开发。9月比赛结果显示,参赛网站类型丰富,第一名网站上线首月就获得217K的PV。

哥飞
算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
新闻资讯7

100亿美元押注AI:红杉换帅后,寻找“白天鹅”

2026年8月,红杉资本募得约100亿美元。掌舵人林君睿和帕特接受专访,称当下是“白天鹅”市场。此前红杉经历领导层更替,团队调整投资决策,还补仓Anthropic,布局AI多环节。

DeepTech深科技
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化突破

当前VLA模型常依赖视觉线索而非语言指令,导致场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元
开源动态8

文本已死,视觉当立!Karpathy狂赞DeepSeek模型,终结分词器时代

DeepSeek成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。

新智元
算法论文8

迈向原生全模态AI智能体:人大&小红书发布OmniGAIA基准

中国人民大学等团队推出 OmniGAIA 基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。

PaperAgent
算法论文8

OpenClaw代码越改越崩?研究EvoClaw揭示:Agents持续开发成功率仅13.37%

USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。

量子位