可观测体系」共找到 4612 篇相关文章

开源动态7

上下文工程比提示词工程好 10 倍,比 vibe 编码好 100 倍!Karpathy 站台,堪称「全新的氛围编码」。

Andrej Karpathy 提出「上下文工程」概念,Shopify CEO 更青睐它。研究显示开发者因 AI 幻觉和错误多,不信任其生成代码。上下文工程成 AI 辅助开发核心技能,文中还介绍了相关开源项目及使用方法。

AI进修生
算法论文8

关键突破:理论验证了 RL for LLM 路线的行性

传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其高效实现模型对齐。

深度学习自然语言处理
开源动态8

用视频存储文本的黑科技!

memvid-rs是memvid的Rust重实现,将文本文档编码为视频二维码实现存储和检索。它有高性能、用TRUE机器学习等特点,兼容多格式、跨平台,无需安装,适合存档文本语料库等。

GitHubStore
新闻资讯7

征集全国首部AI大模型私有化部署标准起草单位和个人!

智合标准中心组织起草国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》,已正式立项并征集起草单位和个人。该标准能解决企业部署痛点,有全流程覆盖等亮点。

AI工程化
推荐文章7

【博客转载】CUDA Reduction

文章来自Lei Mao,介绍CUDA归约操作。先阐述归约操作在并行计算中的常见性,接着实现两个批量归约求和kernel,还给出构建和运行示例的命令及结果。最后探讨大数组归约求和的方法及性能影响。

GiantPandaLLM
推荐文章7

从后训练回到预训练,LLM+RL 的潜力兑现有有机会走更远吗?

RL与LLM结合是重要技术方向,应用从后训练延伸至预训练。虽看似为LLM+RL带来希望,但RL本身有局限。微软等提出的RPT有潜力,不过训练语料等未广泛验证,且需大量计算资源。

机器之心
产品应用7

Labubu后,一款AI“毛球”潮玩火了:朱啸虎押注,定价399元开售就卖爆

国产AI潮玩Fuzozo(芙崽)618预售爆火,首轮10分钟破千单。它获朱啸虎等投资,主打18 - 35岁女性客群,有五行性格设定,具多模态交互与养成陪伴功能,还构建了独特技术体系

量子位
算法论文8

无需训练,即插即用,2倍GPU端到端推理加速——视频扩散模型加速方法DraftAttention

高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成推理瓶颈。现有加速法效果不佳,为此美国东北大学等团队提出DraftAttention,2倍加速推理且不损画质。

机器之心
推荐文章7

【博客转载】CUDA Shared Memory Swizzling

文章讨论用swizzling技术处理CUDA共享内存bank冲突,它重排索引映射避免冲突且不浪费内存。以矩阵转置为例,对比有冲突、填充、swizzling三种实现,还分析了swizzling和填充优缺点。

GiantPandaLLM
算法论文8

人类创造力的核心机制,AI已经开始掌握了 | 北大CogSci 2025(Oral)

北大团队论文揭示AI开始掌握人类创造力核心机制,提出IEI框架量化评估AI组合创造力。研究发现GPT - 4等在创意理解超普通人,框架优化提升AI创意输出质量,论文被CogSci 2025收录。

量子位