高可用机制」共找到 2802 篇相关文章

算法论文8

能效翻5倍!他们复刻人脑双记忆通路,造出能长效记住上下文的类脑AI芯片

帝国理工学院博士后孙鹏飞和苏黎世联邦理工博士后苏哲及合作者,受大脑皮层机制启发,打造“双重记忆路径”类脑网络及配套芯片,处理语音识别任务时能效比此前优方案5倍。相关论文发表在《自然·机器智能》且代码、设计全开源。

DeepTech深科技
产品应用7

Qwen3-Next全新架构,32K场景MTP吞吐提升10倍

随着模型大小和上下文长度增加,为应对成本和部署挑战,Qwen3 - Next有突破性架构创新,解决上下文长度和总参数缩放问题。它采用混合注意力、超稀疏MoE等,MTP机制让其长上下文推理吞吐量比前身10倍以上。

CourseAI
开源动态8

Kimi K2.5登顶开源第一!15T数据训练秘籍公开,杨植麟剧透K3

Kimi K2.5登上Hugging Face热榜榜首,下载超5.3万。它主打Agent能力,成绩超GPT - 5.2等闭源模型,性价比。官方技术报告公开其用15T数据训练,还搭载Agent Swarm架构,团队还剧透了Kimi K3。

量子位
新闻资讯7

硅谷AI研发精英,每周需工作100小时

在中美争夺AGI“圣杯”进程中,顶尖AI研究员虽拿着薪,但脑力劳动强度极。《华尔街日报》披露,硅谷研究员和管每周工作80到100小时成常态,这虽推动突破,也让从业者面临身心考验与人才流失风险。

新智元
算法论文7

ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍

LLM生成文本时KV Cache内存占用,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独精度保存,其余压缩。实验显示,它准确性、效率好,不过在极短文本等场景有局限。

深度学习自然语言处理
新闻资讯7

突发!xAI联创杨格过劳病离职,给马斯克干活压力山大

xAI联创杨格因长期强度工作患莱姆病离职。此前已有多位核心成员离开。马斯克强调速度的管理风格使员工压力大,其公司管更迭率,不过也有人认为这能筛选出能力强的成员。

量子位
新闻资讯7

亏到发疯!AI编程独角兽年入2亿8,结果用户越多亏得越狠

TechCrunch调查发现,AI编程公司虽收入和估值,但普遍亏损。其运作成本,大语言模型调用费占大头,用户越多成本越,且市场竞争激烈。公司尝试自研模型、被收购、降价、提价等方法扭亏。

量子位
开源动态8

从 Serverless 到 Agent:Cube 系统的一些设计思考

本文从 Serverless 面临的挑战出发,介绍 Cube 系统设计,包括分布式调度、资源池化等。还探讨其在 Agent 场景应用,如极速代码执行、并发 Agentic RL 等,最后展望向行业开源,助力 Agent Infra 发展。

InfoQ
产品应用7

The Batch:924|GPT-5.4:性能更,价格也更

OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更

DeeplearningAI
开源动态8

颠覆传统向量数据库,直接将文本数据编码成视频文件,轻量级革命性的大规模AI记忆解决方案Memvid

Memvid将文本数据编码为视频,改变AI记忆管理,实现百万级文本块闪电语义搜索和亚秒级检索。它存储效、轻量级、可离线,应用场景广,还给出安装、使用、配置等说明,并与传统方案对比。

GitHubStore