生产级架构」共找到 2809 篇相关文章

推荐文章7

超轻量Multi-agent,可独立用于生产,也可扩展LangChain、CrewAI、Agno

越来越多AI玩家加入Multi - agent领域,现有框架复杂冗长。本次分享可用于生产的超轻量Multi - agent Water,它不依赖任何框架,还能扩展LangChain等,文中介绍其核心组成与上手教程。

CourseAI
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒实时生成,还在画面质量等方面升,新增实时绘画板功能。

带你学AI
新闻资讯7

评论赠书 | CXL抢跑AI算力新战场,未来计算架构激发智算生产

AI时代传统架构局限性凸显,CXL技术应运而生。它由英特尔等公司联合推出,解决内存鸿沟问题。‘2024 CXL技术创新方案大赛’推动其发展,《CXL体系结构》一书全面介绍该技术。

芯师爷
算法论文8

彻底改写Transformer!「能量驱动架构」横空出世,通用推理时代要来了?

UIUC、斯坦福与哈佛联合提出全新「能量驱动Transformer(EBT)」架构,打破「前馈即推理」旧范式,以能量最小化模拟人类思维,训练更高效、推理更精准,在多方面超越传统Transformer。

新智元
产品应用8

一张图生成雕刻 3D 模型,效率拉满,绝了!

Hi3D是商品3D模型生成工具,在Hugging Face上连续三周霸榜下载第一。其2.0版本能自动补全不可见结构、消除环境光干扰、优化人像细节。操作简单,还有多种玩法场景,官方还提供兑换码福利。

开源先锋
新闻资讯8

LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4

近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。

机器之心
产品应用7

Qwen3-Next全新架构,32K场景MTP吞吐提升10倍

随着模型大小和上下文长度增加,为应对成本和部署挑战,Qwen3 - Next有突破性架构创新,解决上下文长度和总参数缩放问题。它采用混合注意力、超稀疏MoE等,MTP机制让其长上下文推理吞吐量比前身高10倍以上。

CourseAI
开源动态8

统一VLA范式!港科大开源StarVLA乐高式架构,复现成本大幅降低

当前具身智能的VLA赛道陷入「碎片化」泥潭,方法难对比、复现成本高。港科大开源StarVLA,提出「乐高式」统一架构,构建模块化开源底座,实现双向模块化,还支持多种训练范式,打通Sim2Real。

新智元
产品应用8

MySQL复制延迟终结者:AliSQL 高效AI诊断和四大内核优化

MySQL主从复制延迟损害实例可用性和时效性。AliSQL引入AI诊断定位原因,针对大表DDL、大事务、批量数据处理和小事务高并发四类场景,进行内核优化,消除复制延迟。

阿里云开发者
推荐文章8

玩不过来AI新品?实测10大神Skills,各种AI工具通杀!

2026年AI工具更新快,核心概念是Skills。它比追新工具重要,可跨平台复用。作者实测10大神Skills,涵盖内容处理、设计开发等阶段,还推荐了Skill管理产品Agent Skills Guard。

鲸选AI