超节点计算」共找到 2726 篇相关文章

8

华师大智金院孵化金融原生基模Mint-Agent:越GPT-5.6与Claude Opus 4.8,商业订单已亿元

华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单亿元,进入规模化金融场景验证阶段。

机器之心
新闻资讯7

AI算力饥渴和高能耗困局谁来解?两位95后创始人用相变材料光计算构建新范式

AI算力供需失衡致数据中心能耗激增,传统电芯片性能提升放缓。光本位科技由两位95后创立,2024年6月流片全球首颗128×128矩阵规模光计算芯片,推动光计算商业化,正布局产品商用。

机器之心
开源动态8

牛!小米开源「音频语言模型」,1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
算法论文8

华人团队终结Token危机:扩散模型数据潜力自回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
新闻资讯7

独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资2亿美元

AI科技评论独家获悉,通用具身智能机器人公司无界动力完成天使++轮融资,累计2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建具身大脑,区别于主流架构。还获远景5亿订单,商业化落地成果多。

AI科技评论
开源动态7

Claude时代终结?LMArena实测DeepSeek R1编程得分Opus 4,但月暗称其新模型更胜一筹

在闭源模型主导的AI环境下,开源的DeepSeek - R1(0528)在LMArena测试中表现亮眼,编程得分Claude Opus 4,引发社区关注与讨论。不过LMArena曾被指责偏袒,其联合创始人反驳。此外,月之暗面新模型Kimi - Dev - 72B编程成绩R1。

AI前线
新闻资讯8

OpenAI发布MRC算协议,重塑10万GPU集群通信,AMD等合作推进

OpenAI联合AMD等发布MRC算协议,它基于RoCE标准,打破传统网络局限,解决大规模计算集群难题,降低成本与能耗。MRC有多平面网络等特性,已在多计算机部署,规范也已公开。

AIGC开放社区
算法论文8

√N并行+84倍计算加速!英伟达港大全新图像注意力:空间结构都保留

英伟达、港大等研究人员提出新型视觉注意力机制GSPN,通过线性扫描和稳定性 - 上下文条件处理图像空间结构,降低计算复杂度至√N量级,在多视觉任务达先进水平,生成16K图像加速84倍。

新智元
新闻资讯7

全球AI芯片被一家味精厂卡脖子?份额95%,英伟达也得排队抢产能

AI芯片卡脖子节点藏在供应链深处,日本味之素作为全球AI芯片封装关键材料ABF近乎独家供应商,市场份额95%。英伟达Rubin平台对ABF需求大增,但味之素扩产受工艺良率制约。

新智元
开源动态8

Mamba 架构实现推理性能 Gemma3-27B!推理模型开始迈入「无注意力」时代

PromptCoT - Mamba是首个具解码显存常量等特性且推理能力强的模型。当前推理大模型中注意力机制有局限,PromptCoT - Mamba实现无注意力推理,在多评测集Transformer等模型,为无注意力推理生态奠基。

AI科技评论