几何上下文注意力」共找到 899 篇相关文章

算法论文8

超越Skill?又一新技术让AI编码准确率从53%跃升至100%

Jude Gao主导的新研究带来上下文工程新发现,仅改动8KB的AGENTS.md文件,就让AI编码智能体表现从53%跃升至100%。对比Skills和AGENTS.md两种方案,后者完胜,还解决了上下文膨胀问题。

AI工程化
产品应用8

一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背后

DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选后计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。

AI寒武纪
新闻资讯7

FlashAttention-4震撼来袭,原生支持Blackwell GPU,英伟达的护城河更深了?

在 Hot Chips 2025 上,TogetherAI 首席科学家 Tri Dao 公布 FlashAttention-4,其在 Backwell 上比英伟达 cuDNN 库中的注意力核实现快 22%,还实现两项算法改进。该技术一直迭代升级,提升了注意力计算效率。

机器之心
算法论文8

清华新框架让大模型学会「精读略读」!实现12倍端到端加速,基准评分翻倍

清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍端到端加速,为长上下文LLM部署提供新范式。

量子位
推荐文章8

MCP 和 Skills 到底什么区别?一篇文章说清楚

文章解释了 MCP 和 Skills 的区别。MCP 是 AI 世界的 USB 协议,可降低开发成本,但会吃掉上下文窗口;Skills 采用渐进式披露设计,自带脚本,能减少上下文消耗。未来 Skills 或承担多数工作,MCP 用于远程连接。

宝玉AI
算法论文8

SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能体,更少计算,更强性能

在多模态大模型加持下,纯视觉GUI智能体成通用操作智能体重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。

AI科技评论
产品应用7

比 Context7 更靠谱:Exa-code 靠 1B+ GitHub 与 Stack Overflow 减少幻觉

Exa团队索引超1B+文档、GitHub仓库等内容,exa - code对其混合搜索、分块处理。它是首个为编码代理制作的Web规模上下文工具,在代码幻觉评估中表现超流行网页搜索工具,核心技术有专为AI的搜索引擎和高效返回上下文

AI进修生
算法论文8

浙大提出Translution:统一Self-attention和Convolution,ViT、GPT架构迎来新一轮性能突破

近日,浙大与新加坡国立大学提出新型深度神经网络基础操作Translution,融合Self - Attention与Convolution优势,实现二者统一。基于它构建的网络在ViT和GPT架构下性能提升,但对算力要求更高。

AI科技大本营
产品应用7

Claude Code 新增 Recap 功能,多开党必备神器

Anthropic更新Claude Code,新增Recap功能。切回窗口时,它自动显示摘要,告知操作进度、问题及下一步计划,解决多开党忘记进度的困扰,目前已在终端版上线。

AGI Hunt
新闻资讯7

姚顺雨现场颁奖,吉嘉铭、董冠霆等15位青年人才获腾讯「青云奖学金」

腾讯「青云奖学金」在深圳颁奖,首期选出 15 位获奖者,每人获 20 万现金和价值 30 万云异构算力资源。姚顺雨现身颁奖,获奖者有白雨石、陈俊松等青年 AI 学者,各有出色研究成果。

机器之心