「三阶段架构」共找到 3143 篇相关文章
2027年,人类最后一次抉择
Anthropic首席科学家Jared Kaplan预警,2027 - 2030年人类要抉择是否让AI递归自我进化。还介绍了AI进化三阶段,以及2027年关键的技术和硬件因素,同时Anthropic报告揭示AI对工程师工作的重塑。
SGLang Model Gateway 0.2 发布:企业级一体化AI原生编排
市面上一体化AI原生编排方案稀缺,Oracle和SGLang团队推出SGLang Model Gateway 0.2。它从SGL - Router重构而来,核心能力升级,架构分三层,部署灵活,还支持Kubernetes集成和向后兼容。
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。
LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元
灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。
从GPT-2到gpt-oss,深度详解OpenAI开放模型的进化之路
OpenAI 近日发布 gpt-oss-120b 和 gpt-oss-20b 两个开源模型,Sebastian Raschka 发布博客对其详细分析,回顾自 GPT - 2 以来 AI 社区进步,还与 Qwen 3 比较,介绍架构、训练、推理等细节。
ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路
前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。
港股新贵押注物理AI,乐动机器人打造万亿市场空间的核心基础设施
物理AI时代,机器人需「读懂」物理环境,环境感知能力成竞争焦点。乐动机器人过去十年围绕此布局,有空间感知技术先发优势,其自研模型与架构构建数据飞轮,有望完成向感知基础设施平台的身份重塑。
技术·艺术· 算术:京东零售 AIGC 百亿素材供给实践
本文整理自 QCon 全球软件开发大会·2026 石孝钢演讲。京东零售面对百亿级商品素材供给难题,构建 Oxygen Vision 系统,从艺术、技术、算术三方面探索,实现日供超 1000 万素材,服务超 100 万家商家,核心 XTR 综合提升 29%。
Soul App 又放大招!把 42000 小时数据喂出的“歌神” SoulX-Singer 开源了!
语音合成近年爆发式增长,开源领域也有强大音乐模型。Soul APP联合多机构开源的SoulX - Singer,喂了42000小时数据,主打零样本歌声合成,支持双控制方式,多语言与跨语言能力强,架构先进,评测表现优。
借助 AI Coding 快速打造 AI Agent 系统
文章围绕购物场景生成AI Agent系统展开,原有低代码方案遇瓶颈,团队转向LangGraph等工程方案,借助AI Coding工具重构上线。介绍了项目需求、挑战,阐述核心架构升级,分享AI Coding开发实践及项目成果与启示。