「开源清单」共找到 3006 篇相关文章
大模型推理加速全链路:内存管理、编译优化、量化与并行策略
本文整理自金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。
把本地 AI Agent 接到飞书/微信:一个工具全搞定
cc-connect是开源工具,可把本地AI编程Agent桥接到任意聊天平台。支持10+主流AI Agent、12大聊天平台,有多Agent编排等功能。v1.3.0版更新实用功能,3分钟可完成配置。
Karpathy自称患上AI精神病!能力没有上限,一切都是Skill问题
Karpathy在播客中称自己患AI精神病,日常工作多依赖智能体。他认为智能体能力无上限,瓶颈在使用者技能。还探讨软件变革、自动化研究、模型分化等,对就业、开源等也给出看法。
Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!
国内独角兽月之暗面发布开源模型 Kimi K2,推出两天就在 OpenRouter 超越 xAI 的 Grok 4。它成本优势大,能力泛化和实用性强,编码、Agent 工具调用等方面表现出色,架构与 DeepSeek 相似。
苹果出手!改进GRPO,让dLLM也能高效强化学习
苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。
4月30日凌晨,Meta举行首届AI开发者大会LlamaCon,推出Meta AI聊天机器人应用程序与ChatGPT竞争,发布Llama API。Meta试图强化开源模型生态系统以限制OpenAI发展,扎克伯格与微软CEO还探讨了开源闭源模型生态等内容。
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26
大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。
没有全科优秀,具身模型别想进入百万小时
文章介绍权威评测 RoboDojo,给全球机器人模型办‘高考’,多数具身模型离落地远。原力灵机的 DM0.5 模型登顶,它记忆能力强、全科优秀,且全面开源,有望推动具身智能发展。
上百个Agent,该怎么管?清华团队新思路:重做Session
当Agent数量增多,管理难题凸显。清华与中大团队开源OpenRath,以Session为核心,让多Agent共享状态。它借鉴PyTorch,解决了证据存储、状态流动等问题,使Agent集群管理更高效。
分享一个 Skill:如何找到值得做的创业 idea
作者分享找创业想法的方法,认为AI时代想法重要性回归。介绍通过AI获取各平台信号,还推荐Tabbit浏览器,其能创建复用妙招扫描机会,给出结构化清单,还可定时执行,有共享社区。