Token压缩技术」共找到 3511 篇相关文章

算法论文8

大模型赋能的具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent
开源动态7

Meta没做的,英伟达做了!全新架构吞吐量狂飙6倍,20万亿Token训练

英伟达发布全新架构9B模型NVIDIA Nemotron Nano 2,以Mamba - Transformer混合架构实现推理吞吐量最高提升6倍,对标Qwen3 - 8B并在多任务中表现持平或更优,还开源模型及大部分预训练数据。

新智元
算法论文8

仅用1/9的token拿下SOTA,用LLM当知识路由:全新RAG框架DeepSieve

大语言模型遇「最新」或「垂直领域」知识易出错,传统RAG做法有痛点。全新RAG框架DeepSieve把LLM当知识路由器,四步筛选信息,实验精度高、成本低,消融实验明确各模块价值,还有救场案例。

PaperAgent
新闻资讯7

MMAR与AudioTrust技术解读,音频大模型评测前沿进展分享 | AI Bench Talk直播预告

司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频大模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频大模型相关议题。

OpenMMLab
产品应用8

从亚太到欧美,阿里云瑶池数据库凭何成为中企出海的技术底气?

在中企出海迈向‘深水区’时,阿里云瑶池数据库成关注焦点。它涵盖多版块,能提供全链路生命周期服务。对话负责人薛菲可知,其满足出海数据库需求,在多场景表现出色,融入AI能力,获国际认证,为中企出海提供底气。

InfoQ
新闻资讯7

AI大厂系统提示词泄露:2.7万token里,藏着最好的提示工程课

GitHub上`system_prompts_leaks`仓库扒出Claude、GPT等AI系统提示词。这些提示词像事故档案,规则具体,其结构排序暴露优先级。普通使用者可借鉴,提升对AI提要求的质量。

AI Reading Hub
推荐文章7

AGI时代最稳的饭碗是什么?3Blue1Brown创始人:技术会淘汰,但信任不会

科普视频博主 Grant Sanderson 在播客中指出,AI 因缺乏肉身和生理模仿机制,写不出触动人类灵魂的文章,即便证出黎曼猜想,若证明冗长,对人类也无意义。他还探讨了 AI 在数学领域的进展、局限,以及人类教师和科普作者在后 AI 时代的价值。

AI科技大本营
开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读之基于CUTE DSL的通信计算重叠算子实践

文章是对蚂蚁开源x SGLang Meetup分享的回放解读,聚焦基于CuTe DSL的通信 - 计算重叠内核实践。探讨不同通信计算重叠方案,分析在Blackwell上做GEMM + AllReduce融合算子的优势,介绍multimem指令等,还提及接入模型执行路径和性能结果。

GiantPandaLLM
推荐文章7

AI Native的组织架构应该是怎么样的?Block CEO:每家公司都可以压缩成一个agent

Block CEO Jack Dorsey 认为传统公司层级制度在 AI 时代已无必要,AI 可承担协调等功能。Block 以 AI 为中心重建公司,构建两个世界模型,搭建四层架构,裁员 40%,重新定义人员角色和 CEO 工作。

Founder Park
开源动态8

Hermes Agent 技术深度拆解:36000 Star 背后的架构设计,以及你该怎么用它

Hermes Agent 9 个月获 36800 Star,解决记忆断裂、能力天花板和平台绑定问题。它有四层记忆架构、自主技能进化,支持 200+ 模型,还有 40+ 内置工具、15 个平台适配器。最新 v0.8.0 版本有多项更新,文章还给出使用建议和对比。

AI Reading Hub