行业应用」共找到 3039 篇相关文章

算法论文8

华为中科大联创大模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科大提出CBQ后训练量化方案,仅用0.1%训练数据实现大模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
产品应用7

如何管理和调度Dify工作流?

文章介绍Dify这一开源大模型应用开发平台,指出其工作流存在无定时调度和监控报警、执行记录过多致性能差等痛点。给出Dify Schedule和XXL - JOB两种集成Dify工作流方案,并分析各自优缺点。

阿里云开发者
产品应用8

英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生

英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。

新智元
产品应用7

MCP进阶:一键批量搞定MCP工具部署

在AI应用复杂当下,传统MCP工具集成有痛点。文章提出基于阿里云计算巢的一站式方案,可多MCP工具批量部署,首创双通道调用能力,还介绍部署、使用、增减工具及问题排查等内容。

阿里云开发者
新闻资讯7

谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag

在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有低延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。

InfoQ
开源动态8

Apple | 开源视觉语言模型:FastVLM,可手机运行,首token速度提升 85 倍

苹果开源能在 iPhone 上运行的视觉语言模型 FastVLM,代码仓库含 iOS/macOS 演示应用。它解决体积和速度问题,首 token 输出速度提升 85 倍,引入 FastViTHD 编码器,适配 iOS/Mac 生态,有不同参数量级版本。

AINLPer
新闻资讯7

5Y News|微分智飞连续完成两轮融资,加速空中机器人具身智能研发

近日,微分智飞一个月内完成数千万元天使轮及天使+轮融资。此轮融资用于加速飞行具身智能创新等。公司由高飞教授领衔,成立三月就推出第一代平台,在多领域有开拓性应用

五源资本 5Y Capital
新闻资讯9

刚刚,中国语音AI连拿多项全球第一!

本文报道阶跃星辰推出StepAudio 3全系列五款音频大模型,覆盖听、说、理解、交互、创作全语音链路,拿下三项第三方评测全球第一,分析了语音AI行业从单点竞赛转向全栈体系竞争的新趋势。

新智元
推荐文章9

刚写完V4.1主算子就要“转业”?DeepSeek资深算子工程师深夜独白

本文整理了DeepSeek资深MLSys工程师刘胜与的公开长文,刘胜与刚交付DeepSeek V4.1核心算子,就预判AI将很快超越人类算子开发能力,分享职业转型思考与行业警示,引发技术圈热议。

AI前线
产品应用9

让企业拥有自己的模型!PyTRIO定义TaaS新范式:大模型训练进入API时代

本文围绕企业自主训练专属大模型的行业趋势展开,指出当前大模型训练门槛高、工程成本大的痛点,介绍情感机器推出的PyTRIO训练平台,提出TaaS新范式,封装底层工程,开放训练API,降低训练门槛。

机器之心