CUDA 生态」共找到 912 篇相关文章

新闻资讯7

Meta大手笔收购Moltbook:小札掌控150万AI 智能体,OpenClaw生态颤抖

2026年3月10日,Meta宣布收购Moltbook,这个有150万AI智能体的社区。Meta看重其身份认证与互联架构,想借此补齐“代理人社会”拼图。但收购引发数据垄断担忧和人才出走问题。

鲸选AI
新闻资讯7

【倒计时一周】AI眼镜芯生态沙龙:从芯片到整机的协同创新

当智能手机创新遇瓶颈,AI眼镜成新风口。当前市场高速增长,但面临技术、成本、场景和产业链协同等难题。本次沙龙旨在凝聚产业链共识,解决发展难题,共探产业未来,为各方提供合作契机。

芯师爷
开源动态7

DeepSeek-OCR生态爆发!从前端到跨平台,解锁OCR新玩法!

近年来OCR技术应用广泛,DeepSeek-OCR开源后引发开发者关注。文章盘点其四个衍生项目,有轻量级前端应用、Windows桌面应用、全Rust跨平台客户端和专业PDF转换工具,覆盖多场景。

开源星探
推荐文章7

CUDA博客】关于TensorCore和Inline PTX Assembly的一个超简短笔记

文章围绕TensorCore和Inline PTX Assembly展开,介绍利用PTX指令发挥TensorCore潜力。讲述矩阵乘法和累加操作,给出半精度及替代浮点指令形式,有代码示例并分析,还提到不同数据类型用法及SASS指令。

GiantPandaLLM
开源动态8

从服务器 OS 到 Agent 沙箱:腾讯云如何打通 AI Infra 的生态底座

文章指出代码生成快但执行边界缺可靠设施,腾讯云开源 Cube Sandbox 项目。它基于 MicroVM 路线,突破隔离、速度、密度等门槛,v0.2.0 版本降低部署门槛。与 OpenCloudOS 9 组合,提供全链路开源可控路径。

InfoQ
产品应用7

CUDA 博客】TMA简介 & 让矩阵转置在Hopper GPUs上变得更快

文章介绍Hopper GPU新特性TMA,它能高效传输多维数组数据。文中展示用TMA对2D数组操作,如创建张量映射、编写kernel等。还讲了避免共享内存bank冲突的交织方法,最后介绍在Hopper GPU上实现高效矩阵转置的多种方式及性能。

GiantPandaLLM
开源动态8

欧洲版DeepSeek发布Mistral 3系列模型,多模态端云生态,无差别商用交付给全球开发者

欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。

AIGC开放社区
开源动态8

开源共建重塑推理 Infra:从架构创新到生态协同,Mooncake的破局之路

大模型推理落地面临成本、吞吐、长上下文“三角困境”。开源项目Mooncake以“计算存储解耦”为核心,通过PD分离等技术提供底层支撑。直播邀请专家从多视角拆解其技术逻辑、开源价值与企业实践。

InfoQ
新闻资讯8

专访希姆计算陈炜博士:“技术与人才标准”双轮驱动,推动 RISC-V 生态繁荣

在2025 RISC-V中国峰会期间,希姆计算陈炜博士接受专访,介绍RISC-V在AI领域布局,提及希姆计算推动技术标准制定的贡献与挑战,还阐述国内人才缺口及培养标准,认为技术与人才标准相辅相成。

芯师爷
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心