算力提升」共找到 3573 篇相关文章

算法论文8

推荐大模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本

随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。

机器之心
推荐文章7

详细介绍!RAG 和 GraphRAG:了解何时(When)、如何(How)使用它们

文章详细介绍传统RAG和GraphRAG技术,前者通过向量搜索检索上下文,但无法体现数据关系;后者用知识图谱提升检索效果,亮点是构建图谱、整合信息。还指出两者优缺点,建议结合使用。

AINLPer
新闻资讯7

独家丨数千万天使轮融资,中科院背景团队「熵旋芯智」押注存内概率计算

AI 科技评论独家消息,熵旋芯智获数千万元天使轮融资,由英诺天使基金领投。该公司是国内唯一基于 MRAM 构建存内概率计算平台的企业,采用全栈软硬协同策略,有望大幅提升能效比,计划 2027 年初交付芯片。

AI科技评论
算法论文8

基于DINOv2和SAM2改进的U-Net模型

DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。

机器学习AI算法工程
开源动态8

多模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。

AI工程化
产品应用8

字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。

机器之心
新闻资讯7

OpenAI:我们正朝着什么方向优化 ChatGPT?

OpenAI 官网文章称,ChatGPT 发展方向是成‘对你有用’的工具,不追逐 DAU 或让用户沉迷。它介绍了有用的使用场景,还提及健康使用方面的改进及与专家合作提升响应能力等内容。

特工宇宙
开源动态7

Meta Shuffling的MoE Grouped GEMM kernel benchmark

作者拷贝fbgemm开源的moe grouped gemm kernel,修复小bug后与SGLang的Grouped GEMM Triton Kernel对比,结果显示fbgemm在MoE模型上性能提升显著,可应用到SGLang的ep - moe的grouped gemm kernel中。

GiantPandaLLM
开源动态7

“同事.skill”不用写了,爱马仕 Hermes 主动“蒸馏”你,还让开发者集体抛弃 “龙虾”?!

近日,Hermes Agent 在国内爆火,获超 3.9 万 stars。它是单 Agent 架构,核心是学习循环,记忆分层管理。其网关功能强大,状态可跨会话留存。背后的 Nous Research 目标是打造抗衡 OpenAI 的开源模型,还引入区块链解决算力问题。

InfoQ
推荐文章7

同一模型便宜50%,API Hub靠什么赚钱?

文章探讨大模型API Hub低价卖Token现象,指出低价出售的常是闲置算力等。分析厂商不官网降价原因,介绍第三方低价来源及Hub盈利途径,给出判断低价Hub能否用的检查清单。

AI Reading Hub