架构经验」共找到 2295 篇相关文章

产品应用7

Cursor为Blackwell从零构建MXFP8内核,MoE层提速3.5倍,端到端训练提速1.5倍

Cursor团队从NVIDIA的Hopper H100s升级到Blackwell B200s后遇性能瓶颈,他们回归基础,从零重写MoE训练层,抛弃对现有CUDA库依赖,释放了Blackwell架构潜能,实现MoE层和端到端训练提速。

机器之心
新闻资讯7

硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了

旧金山AI技术大会上,企业大佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。

探索AGI
算法论文8

GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o

浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。

量子位
产品应用7

回归C++: 在GGUF上构建高效的向量模型

Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链的优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。

Jina AI
产品应用8

Claude Code 5亿美元背后的AI工程革命

文章介绍了Claude Code的诞生故事、技术选型、开发流程等。它从听歌小工具变为年入5亿美元产品,90%代码自写,开发流程快,还重新设计终端交互。Anthropic团队各环节AI化,也有特殊条件,有些经验可借鉴。

宝玉AI
新闻资讯7

究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片

近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。

机器之心
开源动态8

又是王冠:27M小模型超越o3-mini!拒绝马斯克的00后果然不同

27M小模型HRM由拒绝马斯克的00后王冠开发,超越o3 - mini - high和DeepSeek - R1,推理不靠思维链。它采用分层推理等五项核心技术,在多测试中表现出色,虽被指通用性不足,但有人看好其仿脑架构

量子位
推荐文章7

MCP for 可观测2.0,6个让MCP开发更高效的小妙招

文章介绍MCP这一开放协议,它能标准化AI模型与不同数据源和工具连接。分享配置MCP开发所需客户端、API等步骤,阐述阿里云可观测2.0融合MCP的实践及效果,还给出设计MCP Server的6个经验,最后展望了MCP应用场景和可观测2.0+AI未来。

阿里云开发者
算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。

GiantPandaLLM
新闻资讯7

独家|前DeepMap 创始人吴夏青离职英伟达创业,瞄准机器人数据方向

AI科技评论独家消息,前DeepMap创始人、英伟达业务副总裁吴夏青2025年12月离开英伟达,正考察机器人数据领域创业。他是资深地图人,DeepMap曾被英伟达约30亿美元收购。

AI科技评论