优化方案」共找到 1964 篇相关文章

算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在多模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
算法论文8

仅需一个混频器的无线射频机器学习推理,登上Science Advances!

杜克大学和MIT教授团队提出广播模型并在射频上完成计算的分离式计算方案,在边缘端混频器模拟计算中完成推理,解决传统方案问题,还在测试平台验证,能耗低且能完成多项机器学习任务。

机器之心
开源动态8

流式数据集:效率提升 100 倍!

现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。

Hugging Face
推荐文章7

如何选择合适的 Diskless Kafka

随着企业将 Kafka 迁移至云原生架构,Diskless Kafka 成趋势。本文剖析其兴起原因,重点探讨开源的 AutoMQ 方案,还对比基于 Leader 与无 Leader 两种架构在多维度的差异,助您选合适 Kafka 方案

InfoQ
开源动态8

如何选择最佳多模态大模型压缩方案?哈工大、度小满开源EFFIVLM-BENCH基准测试框架

金融科技智能化转型中,LVLM部署受算力瓶颈制约。哈工大与度小满联合开源EFFIVLM - BENCH基准测试框架,能为多模态大模型压缩方案出具‘体检报告’,还揭示LVLM加速复杂性,推动技术发展。

机器之心
算法论文8

一篇最新自演化AI Agents全新范式系统性综述

传统LLM Agent工作流固化,面对动态环境只能人工硬编码,成本高、迭代慢。此55页综述提出“Self - Evolving AI Agents”新范式,让Agent自主优化自身结构,还给出三定律、统一框架及各类优化方法。

PaperAgent
产品应用7

Kafka 如何实现零停机迁移

随着企业将 Kafka 迁移至云原生架构需求增加,AutoMQ 成云端优选。但传统 Kafka 迁移方案难满足高可用需求,AutoMQ 推出 Kafka Linking 创新方案,支持双向写入与消费位点同步,实现零停机迁移。

InfoQ
开源动态8

训练时间减半,性能不降反升!腾讯混元开源图像生成高效强化方案MixGRPO

混元基础模型团队提出全新框架MixGRPO,结合SDE和ODE,简化MDP优化流程,提升效率与性能。还推出更快变体MixGRPO - Flash。MixGRPO训练时间降近50%,MixGRPO - Flash再降71%,效果和效率优于DanceGRPO。

量子位
推荐文章7

对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限

AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。

InfoQ
新闻资讯8

斯坦福华人天团意外爆冷!AI用纯CUDA-C编内核,竟干翻PyTorch?

斯坦福华人团队用纯CUDA - C编写的快速AI生成内核超越PyTorch,成果登上Hacker News热榜。研究者采用KernelBench任务设置,引入新优化方法,实验显示多数最优内核在靠后轮次出现,优化策略集中在几类常见模式。

新智元