高性能Kernel」共找到 3449 篇相关文章

产品应用7

使用 Node.js + OpenAI + MongoDB 实现文本向量知识库搜索

本文介绍用 Node.js、OpenAI Embedding API 和 MongoDB 实现文本向量知识库搜索系统,涵盖环境准备、文本切分与向量存储、本地语义检索等,还提及用 MongoDB Atlas 提升性能及后续延伸方向。

AI Reading Hub
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
推荐文章7

Spring 之父:我不是 Java 的“黑粉”,但我也不想再碰它!这门语言拯救了我......

Spring 之父 Rod Johnson 在播客中回忆 Spring 诞生,分享转用 Kotlin 的历程与感受。他认为开源要激发兴奋感,Kotlin 友好、易读,结合 Spring 近乎完美,还对其未来发展提出期望。

InfoQ
新闻资讯8

刚刚,老黄官宣在中国台北建AI超算!

英伟达CEO黄仁勋在Computex 2025演讲官宣,将在中国台湾建首台世界级巨型AI超算及新总部,还推出GB300等新品,介绍NVLink Fusion等亮点,展望AI发展及通用机器人市场。

新智元
算法论文8

Qwen突破:用「并行计算」代替「堆参数」,新方法内存降22倍、延迟降6倍

LLM进化依赖「堆参数」,存在训练成本、推理慢等问题。论文提出ParScale,用「并行计算」代替「堆参数」,让模型「分头思考」,推理效率提升22倍,旧模型也能改造,落地价值大。

深度学习自然语言处理
推荐文章8

浏览器里的 AI 革命:前端工程师的新战场

AI 进入浏览器和前端,JavaScript 扮演新角色。浏览器端 AI 崛起,能在本地提供智能服务。AI 可增强 JS 应用,有多种工具支持,但也面临性能、模型尺寸等挑战,未来前景广阔。

InfoQ
开源动态8

文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”

港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。

量子位
算法论文8

突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。

量子位
6

新站上线,如何在谷歌上获得曝光和点击?哥飞和良辰美的网站案例分析,揭示了排名、上线时间对流量获取的影响,以及如何通过社群活动激励站长们参与竞争。

哥飞
新闻资讯9

刚刚,Dario紧急抛出AI全球共管计划!

本文报道AI行业围绕监管与发展的多方博弈,Anthropic创始人Dario抛出AI全球共管计划,巨头呼吁减速AI被质疑借监管打造垄断壁垒,同时曝光两大AI巨头疯狂囤算力备战的行业现状。

新智元