新注意力机制」共找到 4338 篇相关文章

算法论文8

告别「一条路走到黑」:通过自我纠错,打造更聪明的Search Agent

为解决知识实时性和推理复杂性挑战,搜索智能体(Search Agent)应运而生,但缺乏自我纠错能力。腾讯联合清华提出 ReSeek 框架,引入动态自我修正机制,还构建 FictionalHot 数据集评估,实验效果良好。

机器之心
7

以史为鉴:从互联网泡沫到英伟达五万亿

文章回顾互联网发展历程及泡沫破灭影响,对比当下AI浪潮,指出英伟达成首家市值破五万亿美元公司。探讨AI是否为泡沫,认为其未来发展或类似互联网,还分析英伟达走势及国产GPU替代、AI边缘推理领域前景。

芯师爷
新闻资讯7

太卷了!专属Coding的一代Arena榜单来了,有国产模型登上榜首

大模型编程竞争激烈,编码能力提升成军备竞赛。LMArena发布世代大模型编码评估系统Code Arena,国产模型智谱GLM - 4.6登上榜首,其编码能力获认可,彰显国产大模型硬核实力。

机器之心
算法论文8

清华上交满分论文证明:强化学习并不能让大模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
新闻资讯7

谁杀死了那篇好论文?AI顶会乱象:好文被刷,低分论文捧上天

一位AAAI 2026审稿人在Reddit匿名爆料,称评审流程乱象丛生,好论文被拒、弱论文晋级,还有疑似“关系稿”。AAAI启用AI辅助审稿系统,本意提升效率,却让评审更不可控,侵蚀学术信任。

新智元
算法论文8

内存直降50%,token需求少56%!用视觉方式处理长文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
产品应用8

自媒体误读了 DeepSeek-OCR:一图胜千言

近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构颖,训练讲究,效果出色,为行业带来思路。

MacTalk
开源动态8

谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了测试集与数据构建范式。

新智元
新闻资讯7

被H-1B签证折磨10年,前微软科学家用AI「掀桌」

美国签证体系成本高、周期长、透明度低,前微软科学家Priyanka Kulkarni创办Casium,用AI改造签证服务,把材料准备时间大幅缩短,近期获500万美元种子轮融资。规下,其服务更显重要。

新智元
开源动态8

Nature点赞!哈佛MIT最作:AI科学家时代来了

哈佛MIT推出ToolUniverse,这一开源框架让AI用自然语言操作600+科学工具,解决了科学研究中AI智能体面临的工具格式不统一等问题,推动科研自动化升级,助力打造AI科学家。

新智元