协同效率」共找到 1569 篇相关文章

产品应用8

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级大模型,还推出“大模型+小模型”协同架构释放企业算力价值。

量子位
新闻资讯7

霍尔木兹海峡封锁18天后,芯片产业还能撑多久?

霍尔木兹海峡封锁18天,全球半导体产业担忧能源储备还能撑多久。芯片产业存在‘能源软肋’,关键材料供应有‘垄断性风险’,全球供应链有关联性风险,凸显了产业在效率与安全间寻求平衡的必要。

芯师爷
新闻资讯7

28岁Alexandr Wang,没走!小扎晒出合照

近日网传华裔天才Alexandr Wang被架空或离职,小扎晒合影辟谣。同时,小扎官宣成立「AI工程部门」,与MSL合作打造数据引擎。Meta开发的牛油果模型被指能力强,若效率数据属实,或为Meta带来利好。

新智元
算法论文7

ICLR 2026 | 越推越快! 首个面向「Test-Time Scaling」的投机解码基准

文章指出推理阶段扩展(TTS)能提升推理大模型解决复杂问题的能力,但会产生大量冗余计算。为此提出首个面向TTS的投机解码加速综合基准,评测显示N - gram方法在特定场景加速潜力大,混合策略性能更优。

AI科技评论
产品应用7

用Spring AI Alibaba把MultiAgent实现从5天压到5小时

Spring AI和Spring AI Alibaba新版本支持Multi - agent编排。文章展示基于Spring AI Alibaba实现Multi - agent,从原理到实战,给出示例代码,解决手写框架问题,对比两种编排方式优劣,强调选对框架可提升开发效率

阿里云开发者
新闻资讯8

黄仁勋2026大模型座上宾:杨植麟

在英伟达2026年GTC大会嘉宾中,杨植麟是唯一来自独立大模型创业公司的代表。过往黄仁勋邀人有“风口预言术”,此次选杨植麟,或因他搞出K2.5、死磕推理效率,能给英伟达讲新故事。

量子位
产品应用8

内存一年疯涨170%,云账单里的“隐性成本”该算清了

2025年下半年存储价格成焦点,DRAM合同价同比涨幅达171.8%,致企业IT采购成本上升。华为云更新Flexus云服务器系列,基于柔性算力技术,打破CPU与内存固定绑定,减少浪费,还引入应用级加速,提升性能。

InfoQ
开源动态7

小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化
新闻资讯8

浙江,冲出一匹碳化硅芯片全球黑马!

在‘双碳’目标与数字中国建设蓝图下,电能管理机遇巨大。黄兴博士指出将供电架构优化为高压直流可降低能耗,关键在于碳化硅功率芯片。其创办的派恩杰半导体,自主研发芯片,从芯片到封装助力客户,迎来产业机遇。

芯师爷
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理