「反思模块」共找到 347 篇相关文章
奥特曼遭遇死亡威胁:凌晨家中被投燃烧瓶
当地时间凌晨3:45,OpenAI CEO奥特曼家中遭20岁男子投掷燃烧瓶,嫌疑人已被捕。奥特曼发文报平安,还分享家人照片,同时写下对AI行业现状思考及与马斯克等冲突的反思。
训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式
大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。
玻尔兹曼入住南京大模型产业集聚区
玻尔兹曼宣布入驻南京大模型产业集聚区。虽24年拿牌照后营收不及预期,上半年业务失利,但反思发现产品力尚可,只是运营推广欠佳,后经与投资人交流及自我思考,坚定业务发展信心。
AI 集成的智能 Profiling 实践:从性能分析到优化闭环
本文由韩钦亭撰写,分享了在已有 Profiling 平台引入 AI 智能辅助模块的实践。介绍了设计思路、工程实现、应用成效,对比不同大语言模型,通过实际案例展示优化效果,还探讨了 AI 在性能优化场景的未来潜力。
全国首部“数据流通交易合规”标准,现公开征集起草单位和专家!
2026年是数据要素价值释放年,数据资产交易却面临合规与安全难题。中国电子商会归口、智合标准中心组织编制《企业数据要素流通交易合规指南》团体标准,涵盖多核心模块,有三大亮点,现征集起草单位和专家。
V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间
近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文中提出视频表征自编码器 V-RAE。它以冻结的视觉基础模型为编码器压缩视频特征,还引入轻量级模块聚合信息。经实验验证,其在视频生成和预测上性能出色。
AI数据工程师在应用中如何"返璞归真"
文章反思‘知识库+Prompt工程+工具调用’轻量级Agent构建模式局限,指出其难应对知识质量、语义理解与规模化维护挑战。提出从‘Prompt驱动’到‘上下文工程’、从‘搭积木组装’到‘全链路闭环’的范式跃迁,并介绍MktAI知识体系建设。
单机H200最快DeepSeek V3和R1推理系统优化秘籍
作者从开源技术分享角度,盘点SGLang对单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。
LLM的下一战:从狂卷数据到精算数据
大模型竞争核心正从比拼数据规模转向数据使用效率和风险管理。文章分享2025两篇论文,介绍高效训练和机器遗忘两赛道,前者有数据价值飞轮5大模块,后者提出三时段分类法、三层次遗忘及评价指标全景。
【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解
DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。