「技术架构」共找到 4194 篇相关文章
Langchain 、 Manus 组了一个研讨会:Agent越智能,死得越快!
Langchain工程师Lance Martin和Manus创始人Peak季逸超研讨Agent,指出Agent越智能死得越快,原因是疯狂调用工具致上下文过大。还介绍解决方案,如压缩与总结不同,Manus做减法架构更优。
视远·正心明智——机器之心2025年度AI榜单正式启动
2025 年人工智能浪潮依旧,大模型快速迭代,新应用形态不断涌现,国内 AI 发展也很精彩。机器之心精心策划 2025 年度 AI 榜单,涵盖最强技术实力企业等多个类别,企业可扫码申报。
从0到1:天猫AI测试用例生成的实践与突破
本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。
“中科院系”两家科技巨头合并:国产算力格局要变天?
美国切断部分对华半导体技术出口,国内算力产业有新动作,海光信息换股吸收合并中科曙光。当下中美算力竞争焦点转向‘生态’,英伟达等靠生态占据优势,此次合并或构建国产算力生态。
国产免费2B开源语音模型征服《莽撞人》!复刻郭德纲最难贯口
国产免费2B开源语音模型VoxCPM 2,联合OpenBMB开源社区等推出。它能复刻郭德纲《莽撞人》贯口,覆盖九种方言、三十门外语,音质达48000Hz。还可在线体验,有降噪等功能,技术独特且开源工具链完备。
量子芯片离商用还有多远?解读半导体的下一代革命
本文深度拆解量子芯片全产业链,指出其成突破半导体产业天花板核心方向。全球多技术路线并行研发,虽有进展但距商用有差距。其商用面临三重壁垒,将分阶段落地,普及后会重塑产业与社会,与传统芯片互补。
北大提出首个复数大模型,2比特量化,推理仅加法,可手机部署!
北大团队提出iFairy方案,将模型权重量化到复数集合,用2比特表示,压缩至原本1/8。推理仅需加减或交换数据位置,成本更低。Transformer架构“复数化”,iFairy模型PPL降10%,性能反超全精度,相关成果已开源。
紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
AI的记忆问题解决了!最强记忆基准99%的准确率
Supermemory团队构建的实验性AI智能体流程,在LongMemEval基准测试中达近99%准确率。其技术摆脱传统限制,以新方式处理信息。ASMR创新数据摄取和检索管道,有两种回答流程,团队计划开源代码。
为什么开发者放弃框架而选择原生 JavaScript
前端开发者正在回归原生 JavaScript。原生 API 和 AI 工具使其成为框架疲劳的解药,成熟的 API、性能考量、AI 助力、微前端与无构建架构兴起等因素促使开发者做此选择。