「稀疏专家机制」共找到 1403 篇相关文章
Claude Code凭什么牛?大模型团队天天用自家产品,发现bug直接就改了
Claude Code虽有争议,但很成功,4个月用户达11.5万。Claude Code负责人透露构建细节,如产品理念、评估标准、反馈机制等,还阐述编程领域变化、模型与工具共同进化等内容。
纽约时报:一名自杀少年父母,决定起诉ChatGPT
纽约时报消息,16岁的亚当用ChatGPT辅助学习,后向其倾诉自杀计划并最终自杀。其父母起诉OpenAI,认为ChatGPT没阻止悲剧,OpenAI虽设防护机制,但长时互动中效果减弱。
NeurIPS 2025:高分论文也可能被拒,只为保住那25%左右的接收率?
NeurIPS 2025将于2025年12月在美国圣地亚哥和墨西哥城举办。近期Meta Review完成,有领域主席称DB track高分论文也可能被拒,因要控制接收率。有学者呼吁提高接收率,也有人吐槽这种做法影响会议声誉。
AgentFly:重塑Agent,无需微调LLM,如我们一样的记忆和经验持续学习
现有LLM智能体依赖静态流程或微调参数,缺乏灵活性且成本高。论文提出基于记忆的在线强化学习框架AgentFly,不更新LLM权重,在多基准测试表现出色,为构建通用智能体提供新范式。
AI 产品定价指南
本文编译对按量计费平台初创公司 CEO Scott Woody 的访谈,探讨 AI 改变软件定价逻辑、不同类型 AI 公司应对之法,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点。
阿里AI 重磅第4发:电影级MOE 视频模型Wan2.2正式开源!
阿里通义团队开源电影级视频生成模型Wan2.2,将光影、色彩、镜头语言装进模型,支持60多参数自由组合。它是业界首个用MoE架构的视频生成模型,推理省计算资源,性能超主流模型,获国外网友盛赞。
AI编程工具一键删光整个数据库还试图隐瞒?Replit 爆出最致命事故,官方连夜补锅
网友 Jason 痛斥 Replit AI 删除其公司整个生产数据库,Replit 曾称无法回滚,实际却成功回滚。Replit 创始人回应称会补偿并复盘,还介绍了公司技术与发展情况,此事引发网友对氛围编码等的讨论。
大模型「越用越快」!SpeedupLLM首次验证,大降56%推理预算
Emory大学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。
彻底戳穿AI「失忆症」!超越OpenAI全局记忆,中国队开源LLM记忆操作系统
大语言模型有「记忆」缺失问题,国内顶尖团队打造出操作系统级AI记忆框架MemOS并开源且可商用。它将「记忆」升为「一级资源」,用MemCube封装记忆,评测显示性能优于OpenAI全局记忆方案。
马斯克Grok 4逆天跑分泄露,「人类最后考试」豪取45%全场第一!
Grok 4跑分提前泄露,在「人类最后考试」中得分高达45%,远超Gemini与Claude,成为当前测试中最强模型之一。马斯克表示Grok 4以「第一性原理」构建推理机制,有望改写LLM格局。