新生态位」共找到 4454 篇相关文章

算法论文8

逐个token太慢!大模型原生并行出token,CMU、英伟达作Multiverse

卡耐基梅隆大学(CMU)和英伟达研究者提出Multiverse,这是能实现原生并行生成的型生成模型。它解决了现有并行生成模型缺乏连贯性等问题,通过多方面协同设计构建推理模型,还开源了生态系统。

机器之心
产品应用8

MiniMax Agent 再进化!正式走向商业级全栈开发

MiniMax Agent 升级成‘全栈开发师’,建立完整交付标准,构建技术生态。它能完成多任务,配置顺滑,可处理前端问题。还在 MCP 生态、支付集成等方面革,从工具迈向数字化商业引擎。

特工宇宙
新闻资讯8

领先于Transformer!架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革大模型扩展路径。

机器之心
开源动态8

鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的标杆

RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创设计揭示模型不足,为研究者提供方向,推动具身智能实用化。

AI科技评论
开源动态8

开源共建重塑推理 Infra:从架构创生态协同,Mooncake的破局之路

大模型推理落地面临成本、吞吐、长上下文“三角困境”。开源项目Mooncake以“计算存储解耦”为核心,通过PD分离等技术提供底层支撑。直播邀请专家从多视角拆解其技术逻辑、开源价值与企业实践。

InfoQ
新闻资讯7

御三家格局松动:Google和Meta同日发布模型,第三名不再稳了?

2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定相似,各有优劣。

DeepTech深科技
产品应用8

编程王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10

Cursor推出全AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。

新智元
算法论文8

真·开外挂!MIT研究:架构0改动,让大模型解锁千万级上下文

MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。

量子位
新闻资讯7

中际旭创市值6000多亿背后:技术卡,一场“蛇吞象”跨界豪赌

A股“易中天”组合里,中际旭创营收和市值居首。其前身中际装备业绩不佳,66岁创始人王伟修2016年“蛇吞象”收购旭创科技,后交棒刘圣。9年营收增180倍,如今稳坐全球光模块厂商第一,还成巨头核心供应商。

芯师爷
新闻资讯7

MCP 或将成弃子

Anthropic工程师发博客‘背刺’自家MCP,提出方案让token消耗大减。方案把MCP服务器转成代码文件运行,Skills或成MCP替代品,虽MCP还有价值场景,但多数情况下代码+Skills更优。

AGI Hunt