GPU实现」共找到 2446 篇相关文章

新闻资讯8

信息量极大!黄仁勋最新论断:AGI已实现,OpenClaw是AI界iPhone,未来将有10亿程序员

黄仁勋与Lex Fridman深度对谈,分享英伟达发展历程、管理方式、技术趋势等见解。他认为AGI已实现,OpenClaw是Token时代的iPhone,未来将有10亿程序员。还探讨了算力瓶颈、供应链、电力等问题。

AI科技大本营
新闻资讯7

Cluely:最具争议的 00 后 AI 创业者,用一款 “作弊神器”2 个月实现 600 万美金 ARR

本文编译自 a16z 与 Cluely 联合创始人兼 CEO Roy Lee 的对话。Roy 分享了 Cluely 的发展路径,它前身是作弊插件,后成 AI 助手平台,靠病毒营销 2 个月实现 600 万美金 ARR,虽有争议但潜力大。

海外独角兽
新闻资讯7

首个为手机而生的通用 Agent?!苹果做不到的事,“野路子”智谱抢先实现

苹果预计 2026 年升级 Siri 实现自主行动,但完整落地的执行型 Agent 未推出。8 月 20 日智谱发布 AutoGLM 2.0,称是全球首个可在手机用的 Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。

InfoQ
新闻资讯7

国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%

继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队多来自 AMD,产品覆盖多领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。

AI前线
产品应用8

大模型落地 B 端营销:京东物流如何用 Agentic Workflow 破解"机械感"难题,实现降本 50%

在数字经济与物流产业融合背景下,B端营销面临挑战。京东物流王春阳分享B端营销实践,从人机协同到全流程大模型培育,用Agentic Workflow破‘机械感’难题,实现降本和转化率提升。

InfoQ
新闻资讯7

亚马逊云科技大中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三大技术准备

亚马逊云科技大中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于大模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三大技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。

AI前线
新闻资讯7

英伟达的局:狂撒15亿美元,从Lambda那租到了搭载自家AI芯片的GPU服务器

据The Information消息,英伟达与小型云服务提供商Lambda达成15亿美元合作,租赁其搭载自研AI芯片的GPU服务器。这并非首次,此前已对CoreWeave如此操作。目的是维护其在云计算市场的主导地位。

机器之心
新闻资讯7

图灵奖大佬向97年小孩哥汇报?小扎1亿年薪买新贵,老将痛诉熬夜捡GPU

新智元报道,小扎砸143亿拿下Scale AI 49%股权引入Alexandr Wang任Meta首席AI官,甚至可能让LeCun向其汇报。而Meta老员工因GPU受限研究受阻,科技圈有人上亿年薪,有人被裁,AI圈呈职业体育趋势。

新智元
算法论文8

32k微调处理百万Token:21倍的推理加速,10倍的峰值显存节省,实现恒定内存消耗

现有大模型处理超长文档易内存爆炸、计算崩溃。阿里巴巴未来生活实验室推出CoMeT架构,有双轨并行记忆系统,能恒定内存、线性时间处理文本,在基准测试超主流方法,实现21倍推理加速和10倍显存节省。

量子位
开源动态8

国产类脑大模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。

量子位