「动态算力分配」共找到 1220 篇相关文章
H100去哪儿了?
X 用户疑问引发关注,H100 供应下降成算力危机。超大规模云厂商和前沿实验室提前锁定产能,核心短缺在于内存与封装工艺。算力危机冲击 AI 生态,产业界有应对方法,但短缺问题短期内难解决。
DeepSeek多模态真的来了?识图模式已开始小范围灰度
4月29日,DeepSeek多模态团队负责人陈小康在X发布动态暗示多模态进展。部分用户在DeepSeek官方App灰度到“识图模式”,这是其主线产品首次有图像理解能力模式,此前多模态人才有流失,官方未说明开放细节。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
斯坦福423页AI报告出炉!中美差距仅2.7%,清华DeepSeek冲进全球前十
斯坦福发布「2026年AI指数报告」,长达423页,揭示全球AI产业版图。指出中美AI模型性能差距仅2.7%,AI发展迅速但人类管控能力未跟上,还呈现出就业、算力、应用等多方面趋势。
Karpathy又双叒叕发新概念了,这次我替你找到了那个产品
Andrej Karpathy提出将LLM算力用于建知识库,引发关注但搭建有门槛。网易有道新出的有道宝库功能类似,能自动理解整理资料,有追问、多模态输出等功能,还打通翻译链路,目前免费内测。
科研数据不再碎片化!一张可计算图,连起整个科研世界
UIUC研究团队打造ResearchArcade,将ArXiv论文、OpenReview评审等碎片数据连接成动态知识图谱。它有多源、多模态等特征,支持多种格式数据导入导出,定义了六个任务,验证了图结构在科研数据处理中的作用。
训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD
清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。
微软打包收购OpenAI?就差一点!
OpenAI奥特曼被董事会罢免时,微软差点雇佣式收购,资金、文书一天到位。微软曾对OpenAI商业化存疑,而奥特曼不想被其完全掌控,签亚马逊大单。此外,马斯克索赔,OpenAI要防御多方围猎。
当黄仁勋将存储定义为「AI运行内存」,基础设施该如何实现物种进化?
AI算力需求使全球内存市场疯狂,黄仁勋称存储技术需重构。XSKY星辰天合发布AIMesh方案,战略转向数据智能,其方案可破传统存储架构三堵墙,还坚持中立,助力企业数据转化。
开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型
由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。