「国产软件栈」共找到 1312 篇相关文章
WSJ:中国AI公司用“飞行硬盘箱”规避美国芯片封锁
美国限制向中国出售先进AI芯片,中国公司想出新招,工程师带硬盘到海外数据中心训练AI,再将结果带回。企业还通过多种方式绕开封锁,同时东南亚数据中心崛起,中东也成新热点。
Mamba 架构实现推理性能超 Gemma3-27B!推理模型开始迈入「无注意力」时代
PromptCoT - Mamba是首个具解码显存常量等特性且推理能力强的模型。当前推理大模型中注意力机制有局限,PromptCoT - Mamba实现无注意力推理,在多评测集超Transformer等模型,为无注意力推理生态奠基。
“不用 Cursor和 ChatGPT、手写代码的开发者,怕不是疯了?”
本文围绕开发者是否应使用AI辅助编程展开讨论。支持者认为大模型能提升效率,解决琐碎问题;反对者则质疑其可靠性。文中还分析了大模型在编程中的优缺点,如能生成代码但也有幻觉等问题,并反驳了一些反对观点。
AI Coding 领域的又一黑马,出现了。
文章介绍了 Vibe Coding 概念走红,提及硅谷合伙人观点。着重介绍 YouWare,其创始人明超平认为 AI 时代需编程分享社区。YouWare 有极简部署、页面优化等功能,虽不完善,但有望成行业黑马。
印度国家级大模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国大学生模型都有20万!
印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 研究突破,支持 10 种印度本地语言,但上线两天仅 334 次下载,投资人批评其成果‘令人尴尬’,引发社区激烈争论。
帮大模型提速80%,华为拿出昇腾推理杀手锏FlashComm,三招搞定通算瓶颈
在大模型推理通算难题凸显的背景下,华为数学家祭出 FlashComm。它包含三项技术,分别在 AllReduce 通信、以存换传、多流并行方面优化,解决通信瓶颈,提升推理性能,未来还将围绕多方向创新。
火遍全网的AI在线生成前端页面DeepSite开源替代LocalSite
LocalSite AI是现代化网页应用,能按自然语言描述生成HTML、CSS和JavaScript代码。它功能丰富,支持多AI供应商,介绍了技术栈、安装步骤、部署方式、使用指南及发展路线等。
国货之光!全球AI存储基准测试MLPerf Storage 3.0结果发布,斩获九项第一|甲子光年
9月1日,MLPerf Storage 3.0基准测试结果发布,XSKY星辰天合旗下MeshFS首次参赛,在并行文件存储赛道获九项第一。该测试覆盖多类负载,可多维度衡量存储系统性能,MeshFS兼顾性能与成本效率。
Anthropic曝光自家整套,AI原生研发手册
Anthropic 在官方博客发布两篇内部实践文章,《The AI-Native SDLC Playbook》讲 AI 承担多数编码工作时软件流程安排,《How Anthropic secures its AI-native software development lifecycle》谈流程自动化后安全体系建设。
华为AI芯片来时的路
文章围绕华为AI芯片发展展开,提及方兴东《昇腾崛起》记录其历程。从战略觉醒到技术研发、应对制裁,华为历经曲折,如提出“韬定律”,发布多款芯片,在逆境中构建生态、拓展市场,展现强大实力与坚韧。