高可用机制」共找到 2818 篇相关文章

新闻资讯7

太初元碁乔梁:AI算法已经跑到单芯片极限|MEET2026

在量子位MEET2026智能未来大会上,太初元碁乔梁表示,当下AI算力需求指数级增长,超智融合成行业共识。单颗芯片性能成瓶颈,太初元碁设计PC link实现芯片互联,还分享了HPC+AI在多领域的落地实践。

量子位
算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出效全图建模方案

随着多模态大模型发展,处理分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
推荐文章7

Solo 创始人做 ToB AI 产品,2 年没融资也做到了 800 万美金 ARR

前几天Arcads创始人Romain Torres称2024 - 2025年做AI笔记等方向SaaS产品,能达100万美金ARR。Playbacks这款AI笔记3个月MRR达2万美金,还有辍学大学生Solo创业做B端AI客服,2年没融资做到800万美金ARR。

投资实习所
新闻资讯7

老外傻眼!明用英文提问,DeepSeek依然坚持中文思考

DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。

机器之心
产品应用8

Claude Opus 4.5 × Agent Skills:从第一性原理深入剖析

文章深入剖析Claude Opus 4.5与Agent Skills,介绍了Claude Opus 4.5发布,结合Agent Skills能让模型有专业级能力。还阐述Agent Skills级设计模式、内部架构及执行生命周期,揭示其工作机制与优势。

PaperAgent
开源动态7

DeepSeek开源MoE新利器LPLB:基于线性规划,专攻训练动态负载不平衡

DeepSeek在GitHub开源LPLB,这是基于线性规划的并行负载均衡器,用于优化MoE模型专家并行工作负载分配。它通过动态重排序、副本构建等机制实现动态负载均衡,支持多种拓扑结构,但也存在成本估算等局限性。

AI寒武纪
开源动态8

首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS

EverMind团队发布面向人工智能智能体的长期记忆操作系统EverMemOS。它在主流评测集表现超此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。

机器之心
新闻资讯7

ICLR 2026出分,审稿员怒喷「精神病」!DeepMind研究员教你绝地求生

ICLR 2026评审结果公布,投稿量近2万篇创新,但分数滑坡,平均分从5.12跌至4.2。审稿人吐槽质量低,甚至有怒喷‘精神病’的情况。DeepMind研究员提供论文反驳指南,称同行评审像‘随机数生成器’。

新智元
开源动态8

杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切

上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,一上线便引发关注。今日凌晨,杨植麟等人在 Reddit 开展 AMA 活动,回应 K2 Thinking 一系列问题,还回顾了其在多项测试中的亮眼成绩。

InfoQ
新闻资讯7

从“卡脖子”到“破局点”:一家中国公司的端半导体键合突围战

芯师爷专访迈姆思半导体负责人潘总,该公司专注端半导体材料“再制造”,技术体系有端SOI制造、异质集成、混合键合三大支柱。其在多领域有领先产品,技术壁垒,产能将逐步扩大,供应链安全可控。

芯师爷