降本增效」共找到 587 篇相关文章

新闻资讯7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版迭代冲突处理、推理部署成优化、开源项目挑战及 GPU 虚拟化趋势等内容。

AI前线
产品应用8

快手 AB 场景提速 145 倍,从 Spark 到 Apache Doris 的加速实践

快手 AB 指标生产场景从 Spark 切换到 Doris 提速 145 倍、资源消耗 72%,刷新 Doris 单机群最大规模。文介绍选择 Apache Doris 的原因,以及在存储、计算、调度、稳定性等方面的优化,对构建 AB 实验平台有参考价值。

InfoQ
7

老黄怒怼玩家根不懂AI!英伟达新AI功能遭全网抵制,游戏圈炸锅了

英伟达在GTC 2026发布DLSS 5,应是“性能革命”,却遭游戏圈抵制。它用生成式AI“注入”光影和材质,从“帮放大画面”变为“帮重绘画面”,玩家不满AI网红脸,老黄称是“GPT时刻”。

量子位
开源动态8

Karpathy最新手搓!复现GPT-2成600倍:仅需507元3小时训练「最好的AI学习项目」

Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成600倍,还列出关键优化技术,设排行榜。

AI寒武纪
开源动态8

推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理

ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗超30%。它在AI分析指数成绩佳,优化计算成,还介绍了训练策略与多维度性能实测情况。

AIGC开放社区
新闻资讯8

谷歌一篇论文引爆存储芯片崩盘!AI内存需求暴6倍,推理狂飙8倍

谷歌发布TurboQuant算法,将缓存压到3 - bit,内存占用为1/6,推理速度提升8倍。该算法冲击存储巨头,引发股价下跌,虽目前未改变采购量,但改写推理成,且从论文到落地的路在缩短。

新智元
新闻资讯8

1.8亿个岗位数据分析揭秘,AI究竟取代了什么工作

Revealera联合创始人Henley Wing Chiu研究近1.8亿份全球岗位数据,发现2025年全球招聘岗位总量8%。创意执行、监管环境等岗位跌幅大,AI相关、高层领导等岗位增长或表现坚韧,AI影响有选择性。

AIGC开放社区
新闻资讯7

GPT-5「全家桶」爆出周上线!惊艳首测秒出网页,编程彻底起飞

传闻GPT - 5发布时间提前,月底面世,它有4个版。网友在LMArena实测,GPT - 5 - pro能一键生成网站,GPT - 5 - high表现出色。美国部分公司已拿到预览版,其新功能或改写编程局面。

新智元
新闻资讯7

OpenClaw中国行北京站落幕,3万人围观养虾,周12城活动继续

2026年3月21日,OpenClaw中国行首站北京站举办,近200名开发者参与,3万多人次在线围观。活动承诺30分钟跑通AI应用,多位嘉宾分享使用经验与见解,还设置开放麦环节。周末将登陆12城继续活动。

InfoQ
产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成约75%。它结合稀疏与线性注意力,采用混合架构,继承权重低成,在长文处理上优势明显。

AIGC开放社区