几何上下文注意力」共找到 899 篇相关文章

推荐文章7

企业数字化转型新引擎:MCP + LLM + Agent 架构赋能!

本文介绍MCP(Model Context Protocol)模型上下文协议,它是Anthropic于2024年11月底推出的开放标准,可统一大模型与外部数据源和工具通信协议,打破数据孤岛,有诸多优势,还适用于多个场景。

MCP Server
推荐文章8

5 万行代码 Vibe Coding 实践复盘:最佳实践、关键技术,Bitter Lesson

大厂资深工程师分享 3 个月用 AI 写 5 万行代码的体验,介绍 Vibe Coding 实践,分析 Coding Agent 关键技术如语义搜索、MCP,对比 Cursor、GitHub Copilot、Cline 等产品,还提到 Agent 开发要避免过度植入人类经验。

海外独角兽
产品应用8

AI生图迎来大升级:图像编辑达到像素级!背后团队大多来自Stable Diffusion模型基础技术发明团队

Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它能以文本和图像为输入,有 Pro、Max、Dev 三版本,已在多平台上线,获用户好评,但也面临竞争。

AI前线
新闻资讯7

腾讯把WorkBuddy这张王牌,开放给100多家公司|甲子光年

9月2日,腾讯WorkBuddy举办生态发布会,开放平台正式上线,首批引入超百家生态伙伴,开放底层Agent能力。其在AI办公赛道竞争激烈、产品同质化的背景下做出此开放动作,且面临生态繁荣、商业化等问题。

甲子光年
开源动态8

Qwen3.8-Flash-Next:SGLang Day-0 支持

2026年8月26日,Qwen团队开源多模态MoE模型Qwen3.8 - Flash - Next,它是Qwen4架构早期预览版。SGLang在发布首日就提供完整支持,模型架构多方面升级,亮点众多,还给出启动命令及配置建议参考。

GiantPandaLLM
推荐文章7

笑死,网友支招,破Agent长对话"变蠢"

文章指出用AI编程时,上下文一长模型就易“变蠢”,如违反约束、反复改文件等。分析原因是难从海量历史找重点,给出应对策略,还介绍Claude Code、Cursor、Codex等工具操作方法。

CourseAI
新闻资讯8

中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产

5月25日,华为何庭波在ISCAS 2026上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片晶体管密度达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。

InfoQ
产品应用7

大规模工程支撑场景下的多智能体系统设计:Grab 实践案例

Grab分析数据仓库(ADW)团队推出多智能体AI系统,处理数据仓库故障排查等工程请求,减少重复性运维。团队搭建多智能体架构,整合工具生态,考虑安全治理,解决上下文管理挑战,提升工作效率。

InfoQ
推荐文章8

Agent Skill规范、构建与设计模式

文章深入解析 Agent Skill 的规范、构建与设计模式。介绍了 Skill 规范标准、三层渐进式加载机制和触发机制,阐述了 Skill-Creator 和 Writing-Skills 的核心思想,还总结了 Google 的 5 种 Skill 设计模式,最后指出 Skill 生态已形成完整知识体系。

阿里云开发者
算法论文7

做RAG这一年,最后悔的就是上知识图谱

基于知识图谱的检索增强生成在问答任务中存在三元组索引丢失上下文语义问题,作者提出MDER - DR双阶段框架,在标准测试和特定数据集上性能提升最高66%,还具备多方面优势。

PaperAgent