「后训练策略」共找到 4387 篇相关文章
马斯克狂砸16亿「买」他5年!揭秘特斯拉2号人物,那个睡工厂的狠人
特斯拉授予全球汽车业务高级副总裁朱晓彤超52万份股票期权,价值2.33亿美元,需坚守5年完成KPI。他出身非典型,从建设充电网络到拯救特斯拉上海工厂,后成全球二号人物,还将助力Optimus量产。
百川开源医疗大模型 M3,王小川:今年会发布两款 ToC 产品,正在做硬件
1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗大模型Baichuan - M3,评测成绩突出。王小川表示今年会发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。
Claude Code 2.1 发布:一口气更新了80多个功能特性
2026年1月7日Claude Code发布2.1.0版本,后又跟了2.1.1小修复,更新内容超80条。有Skills自动热重载等新功能、大量bug修复及体验优化。作者建议大家升级,认为它想做完整开发环境。
VLNVerse“宇宙降临”:吴琦团队交出2025具身导航最终答卷
自2018年吴琦团队发表首篇VLN论文后,领域碎片化问题凸显。2025年末其推出全栈平台VLNVerse,涵盖场景生成、物理模拟、任务基准和通用模型,欲打通Real2Sim2Real,推动VLN向Embodied VLN跨越。
十万美元的机械狗,正在“排泄”你的肖像!
迈阿密巴塞尔艺术展上,单价十万美元的《普通动物》作品由三只戴扎克伯格、马斯克和安迪·沃霍尔面具的机械狗组成,内置摄像头,能捕捉画面经AI生成图像后“排泄”出实体作品,迅速售罄,引发不同看法。
记录下SGLang 开发,debug的几个技巧第二弹
作者BBuf继上次分享后,又带来SGLang开发、debug新技巧。包括开启多线程加载模型权重,介绍SGLang Serve模型短期和长期崩溃的调试方法,还提及逐层NVTX Profiling、查看固定batch_size下Decoding性能等技巧。
国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%
继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队多来自 AMD,产品覆盖多领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。
DeepSeek倒逼vLLM升级!芯片内卷、MoE横扫千模,vLLM核心维护者独家回应:如何凭PyTorch坐稳推理“铁王座”
本文介绍了vLLM的发展,自开源后成科技公司首选推理引擎。因DeepSeek发布,团队转向其模型特性优化;还参与各芯片支持工作。vLLM靠PyTorch支持多硬件,同时拓展到多模态推理,面临竞争仍保持优势。
突发!英伟达H200对华解禁,老黄赢麻了
特朗普拍板允许英伟达向中国出售H200,美确保“代差优势”,还抽25%分成。H200性能是H20的6倍,虽落后最新架构,但适合训练推理,此决定或为英伟达带来巨额销售额。
Gemini 3,是谢尔盖・布林「骂」出来的?
ChatGPT 问世后谷歌反应迟缓,创始人谢尔盖・布林回归,亲自写代码,推动 Google Brain 与 DeepMind 合并。他还因 Gemini 被禁止写代码在公司大吵。谷歌推出 Gemini 3 等,坐稳 AI 领域王座,给 OpenAI 带来压力。