赋能增值」共找到 5081 篇相关文章

开源动态7

FlashInfer集成TensorRT-LLM cubin kernel技术分析

文章以MoE模块为例,分析FlashInfer集成TensorRT-LLM的技术。探讨如何不依赖源码用其优化内核、动态加载管理CUBIN文件,介绍集成架构、源码集成技术、CUBIN动态加载系统等内容。

GiantPandaLLM
新闻资讯8

ChatGPT智体正式发布,多个创业赛道昨夜无眠

OpenAI正式发布ChatGPT Agent,将思考与执行力统一,可接管电脑,处理工作和生活多种事务。它优化后力达SOTA,但也有风险。这或重塑互联网,让Agent创业者重新审视竞争力。

量子位
推荐文章7

简单了解下CUDA Green Context

文章基于Flashinfer实现介绍CUDA Green Context,它在CUDA 12.0+引入,实现资源隔离、降低多线程性损失、提高GPU使用率。还给出使用方法及代码示例,不过测试性未达预期,需关注后续发展。

GiantPandaLLM
新闻资讯8

黄仁勋:每天都在用AI,提示工程可以提高认知水平

黄仁勋在CNN访谈称每天用AI,认为提示工程是高级认知技,AI会重塑工作非消灭岗位,还提及中国市场重要性,宣布H20获批入华、将发新显卡RTX Pro,不过其他专家看法不一。

量子位
开源动态8

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性强,编码力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。

InfoQ
算法论文8

用动作分块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA

如今强化学习在多领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利分校研究者提出Q - chunking方法,将动作分块引入基于时序差分的强化学习,解决探索效率和值传播问题,实验表现优异。

机器之心
开源动态7

月之暗面硬刚Anthropic!开源万亿参数Kimi K2,Agent编码性直逼闭源最强!

上周五月之暗面发布并开源万亿参数Kimi K2,外网评价高。它或开启开源AI的“Agentic时代”,在智体和编码基准上表现出色,成本远低于竞品,但推理速度较慢,已可平替Claude。

探索AGI
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用力强。测试显示其性碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
产品应用7

vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存

EmbeddedLLM介绍vLLM新功“休眠模式”,可在不重启服务时几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。

AI工程化
算法论文8

DeepMind揭示Reasoning内在机制

近年来大型推理模型在复杂任务表现出色,但推理机制成谜。本文提出用推理图解码其‘思考轨迹’,分析环状结构、直径大小和小世界特性,发现蒸馏模型等特点,为理解AI推理及模型优化指明方向。

深度学习自然语言处理