「预训练时代」共找到 3275 篇相关文章
Loop Engineering 实战:实现从日志扫描到预发部署的全自主闭环
文章分享 Loop Engineering 实战经验,指出传统维护循环存在看不见、记不住、没闭环问题。介绍了从 Prompt 到 Loop 的四代 AI 工程化范式,阐述 Loop 原理、组件及落地实践,还提及范式迁移和踩坑教训。
极客部落“OPC 创业者招募计划”正式发布,赋能 AI 时代“一人独角兽”
3月20日,极客部落“OPC创业者招募计划”开放日活动举行,聚焦AI时代OPC创业范式。活动揭牌“极客部落·AI应用生态园”,宣讲扶持政策,发布合作基金,探讨OpenClaw对创业生态影响,助力创业者成长。
GPT-6 或有"生命"!MIT新作实现LLM自我进化,冻结权重时代终结
MIT新作《Self-Adapting Language Models》实现LLM自我进化,SEAL框架让模型自己生成“自编辑”微调自身。它能实时学新数据、修复知识、形成记忆。经两种场景验证,小模型也能超越GPT - 4.1等。
AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法
在AI驱动的数据应用场景中,企业需同时支撑实时消费、历史沉淀与多引擎复用的数据底座。传统依赖外部ETL作业的流数据入湖方式有诸多问题,本文探讨‘零ETL’趋势,分析Kafka × Table Bucket方案如何降低复杂度。
强化学习的进化:从PPO到MaxRL,LLM推理训练的算法演进史
本文概述2024 - 2026年推理LLM的强化学习进展,从REINFORCE和PPO讲起,介绍GRPO、RLOO等多种算法。指出critic模型非必需,标准差归一化有副作用,损失聚合很关键,信任域是优化切入点,还提出几个未解决的挑战。
VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案
常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。
阿里千问负责人林俊旸突然离职,Qwen 开源时代要变了吗?
3月4日凌晨,千问核心负责人林俊旸在X发文卸任,3月3日下午他已向阿里辞职。他在阿里大模型研发中贡献突出,推动Qwen3系列开源。外界猜测Qwen或转向闭源,其离职引发业内关注。
AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法
在AI驱动的数据应用场景中,Kafka、Iceberg开放表格式与对象存储组合成流数据入湖重要方向。传统ETL方式有链路长等问题,文章围绕“零ETL”讨论架构减法,介绍Kafka × Table Bucket方案及优势、适用场景。
AI 时代操作系统的三重叙事:技术重构、国产化突围与生态共建
《AI 进化论:智算时代操作系统的破局之路》首期,周明辉、马涛围绕 AI 对操作系统的影响等核心命题展开对话。指出 AI 让操作系统面临挑战,技术演进分两条路径,还谈到安全、国产化、生态共建等问题。
Anthropic 发布 AI-Native 软件开发流程:时代变了,该换套模式了
Anthropic 8 月 21 日发布《The AI-Native SDLC Playbook》,指出传统软件开发生命周期(SDLC)流程重,已不适应 AI 时代。介绍了 AI 原生 SDLC,把旧管控目标和新执行方式结合,还分六阶段阐述具体实践。