「后训练策略」共找到 4349 篇相关文章
Yann LeCun放出憋了20年的大招:Meta开源V-JEPA 2世界模型
Meta发布V-JEPA 2世界模型,参数高达10亿,推理速度比英伟达Cosmos快30倍。它基于Vision Transformer架构,是Yann LeCun倡导多年的JEPA路线成果,仅需62小时机器人数据训练就能执行任务,打脸质疑者。
1000+页PDF解析速度暴涨3倍,MinerU模式不香了
百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。
对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限
AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。
一夜之间,AI终获「永久记忆」!最难考试99%刷爆SOTA,全网直呼疯狂
新智元报道,Supermemory团队推出超级记忆系统ASMR,在AI记忆界最难考试LongMemEval中刷到99%准确率。它抛弃传统模式,采用多Agent并行推理,4月初将开源代码。此外,其背后的Supermemory引擎功能强大,能让AI真正拥有记忆。
对话刘靖康:镜头之外的「智能」和「审美」,才是 Camera Agent 的主战场
影石 Insta360 创始人刘靖康在 AGI Playground 2026 上提出未来影像设备“前轻后重”趋势。他介绍了 Cameraman 愿景,涵盖 Imaging、AI、Robotics 三技术方向,还提到云端 AI 剪辑服务情况及对行业多方面的见解。
HAMi × NVIDIA:GPU 拓扑感知调度实现详解
HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。
蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越自回归模型
蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。
OpenAI官宣自研首颗芯片,AI界「M1时刻」九个月杀到!联手博通三年10GW
OpenAI官宣与博通合作造AI芯片,预计2029年底部署10GW算力。内部已研发18个月,首颗芯片9个月后量产。双方将垂直整合技术栈,还会用ChatGPT设计芯片,目标是实现算力充裕。
苹果再发论文:精准定位LLM幻觉,GPT-5、o3都办不到
近日苹果发布重磅论文,提出 RL4HS 方法,用强化学习训练模型,能准确标出答案中幻觉部分,还使用片段级奖励和类别感知的 GRPO,在片段级幻觉检测任务上超 GPT - 5 和 o3。
一个半月高强度 Claude Code :Vibe coding 是一种全新的思维模式
开发者王巍记录使用Claude Code感受与经验。提到Vibe coding是新思维模式,还分享从传统Editor AI转换的体验,以及CC的边界、使用模式、迭代方式等,也谈到其限制与应对策略。