应用型创新」共找到 3018 篇相关文章

算法论文8

华为中科大联创大模低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科大提出CBQ后训练量化方案,仅用0.1%训练数据实现大模7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
产品应用7

如何管理和调度Dify工作流?

文章介绍Dify这一开源大模应用开发平台,指出其工作流存在无定时调度和监控报警、执行记录过多致性能差等痛点。给出Dify Schedule和XXL - JOB两种集成Dify工作流方案,并分析各自优缺点。

阿里云开发者
产品应用8

英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生

英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。

新智元
产品应用7

MCP进阶:一键批量搞定MCP工具部署

在AI应用复杂当下,传统MCP工具集成有痛点。文章提出基于阿里云计算巢的一站式方案,可多MCP工具批量部署,首创双通道调用能力,还介绍部署、使用、增减工具及问题排查等内容。

阿里云开发者
新闻资讯7

谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag

在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有低延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。

InfoQ
开源动态8

Apple | 开源视觉语言模:FastVLM,可手机运行,首token速度提升 85 倍

苹果开源能在 iPhone 上运行的视觉语言模 FastVLM,代码仓库含 iOS/macOS 演示应用。它解决体积和速度问题,首 token 输出速度提升 85 倍,引入 FastViTHD 编码器,适配 iOS/Mac 生态,有不同参数量级版本。

AINLPer
开源动态8

人类造工具200万年,工具开始研究工具!97年天才少年带队,把“AI寻找研究方向”做成了现实

2026年AI开始研究AI(AI4AI),深圳EvoMap团队用蜂群协作做出产品EvoX。他们创新Agent组织方式,有实验数据支撑其效果,还开源成果AutoResearch解决AI痛点,在生活场景优化旧算法可行。

AI寒武纪
产品应用7

6个Claude Code神作,Anthropic亲选

Claude 官方晒出一批来自普通用户的 Claude Code 「神作」,覆盖实用工具、可视化创意和趣味应用等领域,如人脸涂鸦、医学影像查看器、代码库动态图等。这些项目反映出 Claude Code 正走出传统编程场景。

机器之心
产品应用8

Wan3.0正式上线千问AI平台:稳定、真实、有质感

今天,视频生成模Wan3.0正式上线千问AI平台。它在多维度全面升级,公测以来收到大量反馈,获创作者、企业用户等好评。在多领域经检验表现出色,还持续进化,部分API限时7折,已被多平台接入。

阿里云开发者
开源动态7

DeepSeek 把 Harness 开源了:模、工具、Agent Loop 全是插件

8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置多Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。

InfoQ