「资源压缩」共找到 604 篇相关文章
Claude Code 开发者分享:如何管理百万上下文
Claude Code开发者Thariq分享管理百万上下文的心得。介绍了context概念、腐烂问题及压缩机制,提出完成操作后的五条岔路,还给出不同场景的决策建议,强调会话管理要平衡信息量和注意力。
在一台1970年代的PDP-11上训练Transformer需要多久?答案是5.5分钟
近日,开发者复现1970年代技术环境,用PDP - 11汇编语言实现Transformer并训练成功,项目叫ATTN - 11。在低资源下实现功能闭环引热议,大家思考Transformer到底需要什么。
简单了解下CUDA Green Context
文章基于Flashinfer实现介绍CUDA Green Context,它在CUDA 12.0+引入,能实现资源隔离、降低多线程性能损失、提高GPU使用率。还给出使用方法及代码示例,不过测试性能未达预期,需关注后续发展。
YOLOv8 模型训练入门指南:手把手搞定目标检测AI
本文是从零训练 YOLOv8 模型的完整实录,介绍了 YOLOv8 特点,以“识别猫”为例,详述训练步骤,指出训练难点,还推荐学习资源与工具,鼓励前端程序员尝试做 AI 模型训练。
我去,终于找到原因啦,58.4k Star MemPalace,不敢相信!!!!
AI编程中,上下文压缩后易丢失关键信息。MemPalace将对话和资料按原文存本地,按项目和主题精准找回。本文讲清其存储与检索原理、使用场景、注意事项及安装建议。
独家专访FF创始成员:造车11年交付16辆,贾跃亭为什么还没失败|甲子光年
贾跃亭创办法拉第未来11年,仅交付16辆车。今年他推出新车FX Super One进军MPV市场,引发“抄袭”争议。贾跃亭靠“桥梁战略”“开源节流”和“个人资源能力”让FF存活,该车能否如期销售待察。
上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”
上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。
Anthropic官宣「封杀」OpenAI!GPT-5发布在即,竟被曝用Claude Code做开发?
本周二,Anthropic切断OpenAI对其大语言模型的Claude API访问权限,指其违约用Claude支援GPT - 5开发及安全测试。此举标志AI巨头围绕数据与接口展开新一轮封锁战,API成战略资源。
昔日巨头破产在即,这个半导体赛道还是一门好生意吗?
近期美国芯片制造商Wolfspeed或申请破产保护,反映碳化硅行业产能过剩现状。当下行业赔本赚吆喝,但前景光明,市场资源将向头部集中。文中还介绍多家国产碳化硅企业发展情况。
CC&LG实践|基于 LangGraph 一步步实现 Claude-Code 核心设计
本文深入剖析Claude - Code核心设计与关键技术,结合LangGraph框架,从基础ReAct Agent构建简版Claude - Code,涵盖人工审查、SubAgent实现、任务管理、上下文压缩等多方面,还提及流式响应升级及相关对比。