「后训练框架」共找到 4990 篇相关文章
视觉生成的另一条路:Infinity 自回归架构的原理与实践
本文整理自字节跳动韩剑在AICon 2025北京站的分享,以Infinity为例介绍自回归视觉生成原理,对比其与扩散模型,展示Infinity升级方案成果,它在高分辨率文本到图像任务能与扩散模型竞争。
Meta裁员后续:田渊栋被过河拆桥,姚顺雨等集体「抢人」
Meta在人工智能部门裁减约600个职位,田渊栋团队被裁,原因众说纷纭。此次裁员或为强化Alexandr Wang核心地位,也反映Meta内部研究架构混乱。同时,引发AI公司“抢人大战”。
YC总结的vibecoding核心指南「如何充分利用Vibecoding 」
顶尖孵化器 Y Combinator 总结了 vibecoding 核心指南,涵盖规划流程、版本控制、测试框架等多方面内容,为开发者提供了利用 AI 进行开发的实用策略和方法。
Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求
Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。
2小时入门「个性化联邦学习」,上交清华开源斩获1700+星 | JMLR'25
上海交通大学和清华大学研究人员开源个性化联邦学习代码库PFLlib,含39种算法、3种场景和24个数据集,支持模拟500设备训练,还有隐私保护评估工具,降低研究门槛。
1.9K Star 谷歌开源MCP Toolbox,支持langchain、llamaindex、各类数据库
谷歌开源MCP Toolbox获1.9K Star,支持langchain、llamaindex和各类数据库。它位于应用编排框架间,能简化数据库配置等,可用自然语言交互,还给出python调用方法。
2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹
本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。
Qwen3新成员:Embedding系列模型登场!
今天正式发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3多语言理解优势。在多项基准测试表现卓越,已在多平台开源,有卓越泛化性、灵活架构与多语言支持等特点。
SGLang 某些模型的 CUDA Graph 为什么会有上百条 decode cuda stream?
本文分析SGLang运行DeepSeek-V4.1时,CUDA Graph出现上百条decode CUDA流的问题成因,介绍开源PR的修复方案,分享了压缩profiler显示行数的实用脚本方法。
33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形
ClawBench让AI在144个真实网站执行153个日常任务,结果惨烈,如Claude Sonnet 4.6每三任务翻车两个,GPT - 5.4仅完成10个。它还揭示AI在真实环境的问题,为评估模型提供标尺。