硬件加速」共找到 1056 篇相关文章

新闻资讯7

扎克伯格急了!Meta内部文件曝光:宁用竞品,也要废掉祖传系统

Meta的「超级智能实验室」发起内部革命,加速AI开发。扎克伯格豪赌AI,投巨资重组团队、吸引人才。内部文件显示,Meta强制员工用AI,还让员工弃自研系统,用Vercel等平台。

新智元
产品应用7

全民都在养虾,终于,有人开始给它做“手”了

过去半年,Agent 赛道竞争激烈,大家都在比拼模型等。Violoop 是一块硬件,能在工位打通「看见、判断、动手」闭环,是主动感知型 Agent,它填补了 Agent 生态执行层空白,有独特技术细节,资本看好。

AGI Hunt
新闻资讯7

直接免单!阿里千问30亿请客吃喝玩乐,春节AI大战彻底白热化

阿里千问APP官宣砸30亿开启「春节请客计划」,2月6日起以「免单」请全国人民吃喝玩乐,阿里生态「全家桶」加入。千问已接入阿里生态,借补贴加速AI Agent普及,有望凭「免单+服务」成「生活万事通」。

新智元
新闻资讯8

8亿!OpenAI发布企业AI现状报告

OpenAI发布《2025年企业AI现状报告》,基于真实数据与调研公开企业级AI使用规模。ChatGPT周服务超8亿用户,企业端增长惊人,各行业渗透加速,员工也感受到实际价值,同时前沿与普通用户差距拉大。

AI工程化
开源动态7

DeepSeek悄悄开源LPLB:用线性规划解决MoE负载不均

昨天,DeepSeek 在 GitHub 上线新代码库 LPLB 解决 MoE 负载不均。它利用线性规划算法优化专家并行工作负载分配,能处理动态波动,但也存在忽略非线性成本等局限,对 MoE 架构训练加速有参考价值。

机器之心
新闻资讯7

今日硅谷科技头条是一个游戏机

V社连发VR头显Steam Frame、游戏主机Steam Machine和新款手柄Steam Controller三款游戏硬件,预计2026年初推出。Steam Frame亮点多,Steam Machine性能强,Steam Controller适合PC玩家,V社构建起软硬件+内容闭环生态。

量子位
推荐文章7

[Triton编程][基础]vLLM Triton Merge Attention States Kernel详解

文章详细介绍vLLM中Triton Merge Attention States Kernel的实现,与PyTorch原生实现对比,该Triton kernel最高可实现3 - 5倍以上算子加速。内容涵盖Merge Attention States概念、PyTorch实现、Triton基础算子、分析及性能评估等。

GiantPandaLLM
算法论文8

谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”

谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。

量子位
开源动态8

LeRobot v0.5.0 正式发布

LeRobot v0.5.0正式发布,是规模最大的一次发布。在硬件上支持更多机器人,策略模型新增6种,数据集处理优化,还推出EnvHub,代码库也全面升级,此外社区与生态建设也有进展。

Hugging Face
产品应用7

用 Ollama 本地运行 OpenAI gpt-oss 官方完整教程

OpenAI出教程教用Ollama本地部署gpt-oss-20b或gpt-oss-120b,可实现离线对话、API调用等。介绍模型版本、硬件要求、安装设置,还提及对话、API使用、工具调用、与Agents SDK集成等内容。

AI工程化