多角色架构」共找到 5541 篇相关文章

开源动态8

Kimi开源新线性注意力架构,首次超越全注意力模型,推理速度暴涨6倍

月之暗面发布开源Kimi Linear架构,用新注意力机制首次超越全注意力模型。长上下文任务中,它减少75%的KV缓存需求,推理加速达6倍。核心创新Kimi Delta Attention有细粒度遗忘门控等特点。

量子位
算法论文8

黎曼猜想推至理论边界99.55%!元代理架构AI:在思考中重塑大脑

科学家面临让AI解决复杂科学难题的问题,传统固定架构AI处理特定复杂问题不顺手。近日学术团队提出Eureka架构,能让AI动态“生长”专用“大脑”,在测试中表现出色,还在数学和物理领域有重大成果。

新智元
开源动态8

国产王炸!上海AI Lab开源Lumina-DiMOO,开创模态理解与生成新范式

上海人工智能实验室等机构推出模态生成与理解统一模型Lumina - DiMOO,采用全离散扩散架构。它解决传统模态架构问题,有全离散扩散建模等四大创新,性能在基准测试中领先,应用前景广。

AIGC开放社区
产品应用8

超脑未来WorldDreamer V4横扫个权威榜单,世界模型进入群体智能时代

超脑未来发布 WorldDreamer V4,它以智能体为基本单位,具种核心能力。采用新预训练架构,引入 Masked Agent Modeling,用共享隐式世界状态带来新协同范式,还在权威榜单领先。

机器之心
推荐文章7

规范驱动开发:让架构变得可执行

文章介绍规范驱动开发(SDD),它是软件架构重大转变,以可执行规范为核心,构建五层执行模型,反转传统架构关系,强调漂移检测,明确人机分工,具备五项核心能力,但采用时也面临种权衡。

InfoQ
开源动态7

Meta没做的,英伟达做了!全新架构吞吐量狂飙6倍,20万亿Token训练

英伟达发布全新架构9B模型NVIDIA Nemotron Nano 2,以Mamba - Transformer混合架构实现推理吞吐量最高提升6倍,对标Qwen3 - 8B并在任务中表现持平或更优,还开源模型及大部分预训练数据。

新智元
算法论文8

给你一群顶尖AI,如何组队才能发挥最大战力?UIUC用一个新的智能体协作基准寻找答案

现有的评测基准无法衡量智能体系统内部的协作效率、沟通质量和竞争策略。为此,伊利诺伊大学厄巴纳 - 香槟分校的研究者推出 MultiAgentBench,能全面评估 LLM 智能体系统协作与竞争能力。

机器之心
开源动态8

DeepDiver-V2来了,华为最新开源原生智能体系统,“团战”深度研究效果惊人

华为发布DeepDiver-V2原生智能体系统,采用“团队作战”模式,在复杂知识问答和长文报告生成上表现出色。它以Planner为中心协调个Executor,有智能任务分解等优势,训练也有新机制,昇腾NPU集群加速。

量子位
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在榜单成绩亮眼,语种和任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
开源动态8

Ilya刚预言完,世界首个原生模态架构NEO就来了:视觉和语言彻底被焊死

当Ilya断言大模型未来在于架构创新时,中国团队推出全球首个可大规模落地的开源原生模态架构NEO。它颠覆传统拼接模式,从根上融合视觉与语言,以简洁架构证明架构聪明才是下一代AI竞争力。

量子位