高可用机制」共找到 2790 篇相关文章

开源动态8

AGI新技术路线:下一代稀疏注意力机制Monte Carlo Attention开源

超对称技术公司开源了 Monte Carlo 注意力机制,用于新版基座模型 BigBang - Proton。它在二进制块编码技术上,用块间代表交流机制实现线性复杂度,解决了传统方法的缺点,可实现理论上无限的上下文长度,对现有预训练技术和硬件设计影响深远。

InfoQ
新闻资讯7

星海图继扬:具身智能下半场,应用为王

星海图CEO继扬在AGI Playground大会分享具身智能观点,认为2026年是下半场,核心是应用。具身智能发展慢因缺质量数据和合适本体,未来产品形态或为‘整机+预训练模型+后训练工具’,下游将形成大生态。

Founder Park
推荐文章8

硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。

文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。

AI大模型应用实践
新闻资讯7

M系列芯片一号人物准备离开,苹果管流失正在失控

近期苹果管变动不断,12月1日负责机器学习与AI战略的级副总裁宣布退休,4日设计总监离职。此外,‘苹果芯片’之父也考虑离开,还有多位管有离任计划。苹果发展策略保守,留不住人才,库克时代或近尾声。

机器之心
算法论文8

痛点突破:YOLOv26引入AAttn区域注意力机制,精度提升1.3个百分点

文章介绍YOLOv26引入AAttn区域注意力机制,解决传统机制在复杂场景下的不足。它通过划分特征图区域学习权重,提升检测精度,且实现简单。经实验验证,精度提升显著,还给出实现细节与优化建议。

机器学习AI算法工程
新闻资讯7

波士顿动力泯然众人了,管集体出走,机器人“量产”只能造4台

波士顿动力放出新版Atlas机器人新demo,其完成难度体操动作。此为2026年初CES展示的量产版,主打企业级应用。但上市前夕管集体出走,且Altas月产量仅4台,引发对其前景的质疑。

量子位
开源动态8

Mini-SGLang,30万行代码浓缩为5000行,大模型推理性能教学与研究模版

SGLang发布Mini-SGLang,将30万行代码缩至5000行,保留核心特性,为大模型推理提供性能教学与研究模版,解决教育门槛和科研原型开发难的痛点,还经测试验证了性能。

AIGC开放社区
开源动态8

用短视频成本生成长视频,字节Seed新注意力机制让计算量降低85%

字节Seed与斯坦福等机构推出新模型,其新注意力机制MoC能让长视频生成计算量降低85%,质量不减且保持连贯性。团队将视频生成定义为上下文检索任务,提出MoC机制并阐述实现方法。

量子位
产品应用8

阿里云Tair KVCache仿真分析:精度的计算和缓存模拟设计与实现

阿里云Tair KVCache团队推出Tair - KVCache - HiSim,这是面向分布式多级KVCache管理的保真LLM推理仿真分析工具。它能在通用CPU上精度预测性能,支撑计算选型、存储规划和调度协同等决策,还介绍了其架构、组件、验证及性能评估等内容。

阿里云开发者
算法论文8

单卡4090也能质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了

视频编辑门槛、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量、功能广、开销低,解决了时序、结构和编辑幅度问题。

机器之心