云计算市场」共找到 1695 篇相关文章

新闻资讯8

Transformer危!谷歌MoR架构发布:内存减半推理速度还翻倍

谷歌推出全新底层架构Mixture-of-Recursions(MoR),推理速度提高2倍、KV内存减半,首次在单一框架实现多任务处理与动态分配计算资源,研究人员通过实验验证其性能超Transformer。

量子位
算法论文8

50年僵局打破!MIT最新证明:对于算法少量内存胜过大量时间

MIT理论计算机科学家Ryan Williams最新研究建立数学程序,将任意算法转化为占用空间更少的形式,证明少量计算内存比大量计算时间更有价值,打破计算机科学家近50年认知。

机器之心
新闻资讯7

B站爆了!Hermes首度直播回应「抄袭」,MiniMax提前杀入Harness赛点

Hermes Agent业务负责人回应抄袭质疑,技术对谈探讨AI竞争新维度。MiniMax动作密集,构建“Model + Harness”双向飞轮,其模型获海外开源圈认可,产品驱动模型优化,还与厂商合作解决沙箱问题。

新智元
推荐文章7

当 AI 开始重写负载,数据库该如何重新设计?

AI正改写数据库命题,新数据对象进入生产链路,AI Agent带来更复杂任务链路。在腾讯数据库DBTalk上,三位研究员从不同方向探讨当负载被AI改写,数据库该如何重新设计,包括内核优化、资源管理和测试测评等方面。

InfoQ
算法论文8

「有望成为Transformer杀手」,谷歌DeepMind新架构MoR实现两倍推理速度

谷歌DeepMind发布新架构MoR,有望成Transformer杀手。它统一实现参数共享、自适应计算,兼顾性能与效率。实验显示其推理吞吐量提升,降低计算需求,但能否取代Transformer存疑。

机器之心
新闻资讯7

被传GPU部门被中芯国际收购,Imagination:消息不实

近期市场传中芯国际拟收购Imagination GPU部门,该公司昨晚声明辟谣,称未与任何公司就出售GPU IP业务达成协议,保持独立运营,GPU业务稳健,还将追究散布虚假信息者法律责任。

芯师爷
新闻资讯8

百度想明白了:旧供给到达极限了

当下企业应用AI时,Token成本高、推理效率低问题凸显。百度Create大会释放旧供给达极限信号,推出新全栈AI,含Agent Infra和AI Infra两层架构,多个场景应用初显成效。

InfoQ
推荐文章8

昇腾MindSpeed:分布式训练加速库的创新实践与突破

在2025年QCon全球软件开发大会上,华为工程师郑加利分享昇腾MindSpeed分布式训练加速库。它在计算、通信、显存等多维度优化,提升训练效率,还介绍业界加速库及MindSpeed架构,阐述多种优化策略。

InfoQ
新闻资讯7

老黄200亿「钞能力」回应谷歌:联手Groq,补上推理短板

谷歌TPU威胁刚至,英伟达砸200亿美元联手Groq布局AI新时代。知名投资人指出Groq LPU推理速度远超GPU、TPU等,但内存容量小。英伟达借此补推理短板,入局竞争激烈的推理市场

量子位
新闻资讯8

震撼全网,AlphaEvolve矩阵乘法突破被证明为真!开发者用代码证实

开发者用Claude写代码证实谷歌DeepMind的AlphaEvolve求解矩阵乘法的突破为真,它将4×4复数矩阵计算次数从49次减到48次。小哥测试代码各项指标与论文报告一致,还上传到GitHub。

新智元