分离式计算」共找到 1354 篇相关文章

新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。

机器之心
推荐文章8

Anthropic 的 Harness 设计:build to delete

Anthropic工程博客发布Harness设计文章,探讨Claude完成全栈应用开发任务。指出单Agent模问题,采用GAN对抗、三Agent编排,对比单Agent与多智能体产出,还介绍调教评估者及编排简化,提出Build to Delete原则。

AGI Hunt
推荐文章7

当AI成为预言家:大数据时代,我们正在失去理解世界的能力吗?

文章借神经科学家Grace Huckins观点,探讨AI时代人类理解世界能力问题。以‘微处理器论文’实验为例,指出大量数据未必带来理解。还阐述理解与预测分离、科学理解危机等,强调理解应是科学核心。

AIGC开放社区
推荐文章8

长上下文不再难:KV Cache 全生命周期优化实战

长上下文大语言模型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果。

AI前线
算法论文8

全新预训练数据筛选方案,让数据效率提升10倍!配置仅需fastText评分器|港科大vivo出品

香港科技大学和vivo AI Lab提出轻量级高效数据选择方法PreSelect,已被ICML 2025接收。它只需训练部署基于fastText的评分器,减少10倍计算需求,在多数据集实验中效果显著优于其他方法。

量子位
新闻资讯8

震撼,马斯克联手老黄扔出星际大脑!AI算力中心射上天

SpaceX财报公布,携手英伟达推出轨道AI计算网络Starmind,将AI算力底座搬至太空,解决耗电与散热问题,还介绍了其卫星、优势及马斯克建造太空AI大脑的计划和野心。

新智元
推荐文章7

从 SQL 到自然语言,下一代 Lakehouse 为何必须「AI 优先」

随着大模型技术爆发,数据分析范重构,未来数据多模态、分析复杂、查询方转变。文章指出构建下一代 AI-First Lakehouse,要在存储计算、内核能力、架构适配、平台自治等方面升级,打破数据壁垒。

InfoQ
产品应用7

关键技术详解|腾讯一念 LLM 分布推理优化实践

InfoQ 邀请袁镱分享《一念 LLM 分布推理优化实践》。介绍了“一念 LLM”设计思路、推理优化挑战与突破等,还对比不同框架,指出优化方向,如先实现 PP,再推进 EP 与 PD 分离

InfoQ
开源动态8

告别抽卡、散装工具拼凑!通用AI视频智能体框架UniVA开源

在AI视频创作中,创作者常因频繁切换工具而疲惫。近期多所高校联合开源的UniVA框架,像「AI导演」,能整合视频工具,提供一站自动化体验,改变「抽卡」创作,还支持多轮交互等功能。

新智元
产品应用7

让YOLO飞起来:从CPU到GPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模切换到GPU模的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程