大模型架构图」共找到 9813 篇相关文章

开源动态8

性能涨!阿里开源新版Qwen3模型,霸榜文本表征

今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在多语言文本表征和排序任务中超越众多模型,还采用了多种创新设计与训练方法。

AIGC开放社区
新闻资讯8

老黄斥资60亿美元,打造全球顶尖开源模型

多家外媒爆料,英伟达计划斥资60亿美元打造全球最强开源权重AI模型。为此,英伟达买下Poolside的技术,挖走其核心团队,追加巨额投资。这让AI模型竞争格局或变天,英伟达也将与客户成对手。

新智元
开源动态8

模型优秀脑齐聚硬核开源聚会,SGLang社区举办国内首次Meetup

10月25日,SGLang联合美团、亚马逊云科技在北京举办国内首场Meetup。SGLang是开源高性能推理引擎,特性丰富。活动中咖和开发者分享见解、进展、应用场景,展现其社区活力与发展潜能。

机器之心
新闻资讯8

模型全面爆发,所有榜一都是Gemini!谷歌一夜站到了台前

北京时间今日凌晨,Google I/O 2025 开发者会开启。谷歌发布或升级系列 AI 工具与服务,如升级 Gemini 模型、推出编程智能体 Jules 等,还展示视频图像生成模型、搜索与购物模式升级,展现其在 AI 应用领域强势回归。

机器之心
算法论文8

拥抱模型:深入剖析ReAct的核心原理、技术架构及其对AI领域的深远影响

文章深入剖析ReAct,它是普林斯顿学和谷歌团队提出的智能体架构范式,将推理与行动协同,构建TAO闭环。介绍其原理、架构,指出解决传统AI难题,也存在局限,未来可与强化学习等融合。

腾讯技术工程
算法论文8

物理AI的「原生」时刻:原力灵机发布具身模型DM0

主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心
开源动态8

专为“超模型而生”,新一代训练引擎 XTuner V1 开源!

9月8日,上海AI实验室开源书生模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。

OpenMMLab
开源动态8

创智刘鹏飞、Sand.ai曹越,两AI青年学者团队联手,开源音视频基座模型

开源多模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。

机器之心
算法论文7

Waver:面向统一图像与视频生成的高性能基础模型

字节提出的Waver是面向统一图像与视频生成的高性能基础模型,支持T2V、I2V、T2I。它引入新架构、结合筛选流程与质量模型。虽有局限,但表现出色,架构设计独特,功能多样。

带你学AI
开源动态8

你的AI“体检”了吗?开源AI红队测试平台,一键自查三风险

AI圈一边是顶尖模型发布,一边是模型被“越狱”输出有害内容。腾讯朱雀实验室开源A.I.G平台,能模拟真实攻击对AI产品全方位风险扫描,有模型体检、基础设施漏洞扫描、MCP Server风险检测三核心能力。

腾讯技术工程