「后训练方案」共找到 4388 篇相关文章
离开大厂后,“中国自动驾驶第一人”输了两次 | 甲子光年
曾被誉为“中国自动驾驶第一人”的王劲,离开大厂后创业两次皆失败。他先创办景驰科技,后因百度诉讼离开;又成立中智行,坚持车路协同技术,却因落地难、管理问题等破产。
对话 Coddie 何鋡威:95 后,华为、传音、拓竹历练,用特斯拉的思路做母婴产品
Coddie创始人何鋡威,95后,曾任职华为等企业,后投身母婴赛道。他认为母婴行业产品差、毛利高,缺乏极致产品。Coddie用AI改造该赛道,做育儿大脑和生态,欲成母婴界特斯拉,目标欧美市场。
OpenAI携手五巨头开源革命性超算协议:一举解决超大集群LLM训练不稳定和网络性能难题
OpenAI联合英伟达等五巨头推出超算开放网络协议MRC并正式向行业开放。MRC目标是性能可预期,有多平面网络、自适应包喷射、SRv6源路由三大核心机制,已在OpenAI多台超级计算机上部署。
ICCV 2025|训练太复杂?对图片语义、布局要求太高?图像morphing终于一步到位
图像处理中‘图像morphing’常见又有创意,但以往技术有训练复杂等问题。南洋理工大学等团队提出FreeMorph方法,无需训练实现图像变形,通过改进注意力机制解决特征丢失和过渡不连贯问题,实验效果佳。
无招回归后的钉钉 AI 重构:姿势尚显笨拙,但方向更对了
过去一年多科技行业进入AI泡沫阶段,多数产品只是+AI微创手术。钉钉发布8.0版本,推出钉钉One、AI搜问等新产品。无招想从旧范式向AI原生范式迈进,虽部分产品尚显不足,但方向值得鼓励。
LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元
灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。
全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构
随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。
绝对零监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新零数据训练范式问世
清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。
Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好
Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。
OpenAI这招太狠!AI从「躲猫猫」到「自爆黑料」,主打一个坦白
随着AI进入高风险场景,透明、安全变得重要。OpenAI提出「忏悔机制」,让模型回答后产出自我坦白报告,不影响主回答评分,只考察诚实,能提升不良行为可见性,目前仍处概念验证阶段。