「混合线性架构」共找到 2039 篇相关文章
别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析
agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。
115万片晶圆,决定2026年的“芯片战”,苹果、联发科、OpenAI火线入局
2026年“芯片战”激烈,黄仁勋宣称90%的ASIC项目会失败。AI算力芯片出货格局取决于台积电CoWoS产能。英伟达有望拿近60%产能,GPGPU阵营火力强,ASIC用于特定场景,未来或现“GPU+ASIC”混合算力世界。
突发!英伟达H200对华解禁,老黄赢麻了
特朗普拍板允许英伟达向中国出售H200,美确保“代差优势”,还抽25%分成。H200性能是H20的6倍,虽落后最新架构,但适合训练推理,此决定或为英伟达带来巨额销售额。
阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体新纪元
阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。
一文看懂“存算一体”
文章介绍存算一体概念,它因传统冯·诺伊曼架构在数据爆炸、AI崛起下暴露“存储墙”“功耗墙”问题而提出。阐述其发展历程、技术路线、存储介质、应用场景,也指出技术、生态、市场方面挑战,前景潜力大。
全球首个从语言出发构建的智能体:MoonBit Pilot 如何推动自动化软件交付?
MoonBit Pilot是从语言底层构建的代码智能体系统,将AI Agent从“助手”推向“合作者”。它比Cursor、Codex更快更稳定,能云端异步执行,有Sub Agent架构和分段编译机制,或成未来软件工业新标准。
DeepSeek终于丢了开源第一王座,但继任者依然来自中国
几千人盲投中,Kimi K2超越DeepSeek成全球开源第一,总榜第五紧追顶尖闭源模型。虽有人质疑其采用DeepSeek V3架构,但团队称有参数调整。当下开源模型崛起,正打破性能弱的刻板印象。
告别碎片化日志:一套方案采集所有主流 AI 编程工具
在AI编程工具普及的当下,有效采集和分析AI代码生成数据成重要课题。该文介绍一套基于MCP架构的多AI工具代码采集方案,支持多种工具和操作系统,有轻量化、用户无感等特点,已和Aone合作。
减少检索增强生成(RAG)语义缓存中的误报:以银行业为例
文章围绕检索增强生成(RAG)语义缓存展开,指出其虽能提升效率,但设计不当会产生假阳性。以金融服务FAQ系统为例,经多组实验,发现缓存设计比模型优化更能减少假阳性,还给出未来架构路线图。
DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍
DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练量大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。