多芯片并行」共找到 4764 篇相关文章

算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
产品应用7

求稳的安全IP,安谋科技如何守正出奇?|甲子光年

12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式安全防护体系,有抗物理攻击强等五大亮点,能适配不同场景安全需求,完善产品布局。

甲子光年
新闻资讯8

Vibe Coding成AI主战场:22个明星玩家值得关注

AI产品下半场,氛围编程成赛道焦点。国外大厂推新,国内大厂双轮发力。量子位2025Q3 AI 100榜单显示,开发层产品增强Agent功能,介绍了旗舰100和创新100中的明星产品。

量子位
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线
算法论文8

700万参数击败DeepSeek R1等,三星一人独作爆火,用递归颠覆大模型推理

今年6月Sapient Intelligence提出的HRM影响大模型推理结构,四个月后三星研究员Alexia Jolicoeur - Martineau推出TRM,700万参数模型在推理基准测试中超越参数10000倍的模型,还介绍了TRM原理、改进及实验结果。

机器之心
推荐文章7

AI时代下,程序员还有必要系统性啃书去学习吗?

文章围绕AI时代下程序员是否需系统性啃书学习展开。位鹅厂同事分享观点,有人认为要用书籍搭骨架、AI填充,也有人指出要立足问题探索原理,还有人强调经典书籍在核心领域不可替代。

腾讯技术工程
算法论文8

用动作分块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA

如今强化学习在领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利分校研究者提出Q - chunking方法,将动作分块引入基于时序差分的强化学习,解决探索效率和值传播问题,实验表现优异。

机器之心
推荐文章7

周杰伦发的1400万人点赞的AI视频,是怎么做出来的?

周杰伦抖音首条1400万点赞的AI视频,将其人生节点与专辑串联,有史诗叙事感。文章介绍用AI视频首尾帧功能制作视频的方法,还举例岳云鹏、《甄嬛传》、科比等,称AI能倒转时空。

数字生命卡兹克
新闻资讯7

产业服务 | AI数智文创,谱写文旅新篇章—北京AIGC视听产业创新中心·创投会(第二期)圆满成功

北京AIGC视听产业创新中心·创投会(第二期)近日落幕。活动汇聚业内企业、院校、专家等,搭建三维平台征集项目。入围项目涵盖领域,还有特别分享。活动推动AI与文旅融合,为产业发展提供支持。

郎园Station
推荐文章7

我把斯坦福最火的一门课,做成了Prompt来帮我设计人生。

作者受《人生设计课》启发,将课程内容做成Prompt借助Claude辅助设计人生。此Prompt分四阶段,经轮对话生成蓝图,含现状、问题、计划等,还提及原型行动和失败免疫,位同事使用后有新感悟。

数字生命卡兹克