昇腾 910B」共找到 841 篇相关文章

开源动态8

性能逼近闭源最强,通义实验室开源Mobile-Agent-v3刷新10项GUI基准SOTA

通义实验室开源 Mobile-Agent-v3,覆盖多平台,7B 超同类开源,32B 挑战闭源强手。它有基于云环境的全链路开源方案、全栈 GUI 能力构建和可扩展环境强化学习体系,降低部署开销。

机器之心
开源动态8

深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?

昨天,Meta发布约30B参数的多模态Agent模型Muse Glimmer,支持128K级上下文。它采用Apache 2.0许可证开放,有量化版本等。其技术设计围绕显存、上下文管理等问题展开,在多方面做了取舍。

AI科技评论
新闻资讯7

AI音乐赛道单笔最大融资:ACE完成4000万美元Pre-B轮 | 5Y News

AI音乐生成赛道竞争聚焦于‘谁更可控’,ACE团队由郭靖创立,既推出专业音乐制作工具ACE Studio,又面向大众打造Miya平台。公司获4000万美金Pre - B轮融资,欲构建覆盖全流程的音乐平台。

五源资本 5Y Capital
产品应用8

2.12页/秒,MinerU2.5太快了,1.2B硬刚腾讯、阿里

GPT - 4o等刷新OCR榜单,但产业界仍面临文档图像处理难题。MinerU2.5提出1.2B轻量级文档解析模型,采用创新解耦范式,在多基准测试表现出色,单卡吞吐快,还给出可借鉴创新点。

CourseAI
开源动态8

国产免费2B开源语音模型征服《莽撞人》!复刻郭德纲最难贯口

国产免费2B开源语音模型VoxCPM 2,联合OpenBMB开源社区等推出。它能复刻郭德纲《莽撞人》贯口,覆盖九种方言、三十门外语,音质达48000Hz。还可在线体验,有降噪等功能,技术独特且开源工具链完备。

量子位
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
开源动态8

华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。

机器之心
推荐文章7

A 路径 VS B 路径:先攻新加坡还是直取美国?中国科技出海的生死选择题

文章围绕中国科技出海展开,对比 A、B 路径,分析中美市场特点,指出中国软件市场是试炼场,还阐述开源项目全球化路径,认为新加坡可作出海首站,最后推荐 AICon 北京站活动。

InfoQ
开源动态8

升级版Qwen3开源模型深夜来袭,超越Kimi-K2、DeepSeek-V3

深夜阿里千问推出 Qwen3-235B-A22B-Instruct-2507-FP8 版本。新模型通用能力显著提升,在多测评中表现出色,超 Kimi-K2 等模型。还增强多语言知识覆盖等性能,已在魔搭和 HuggingFace 开源。

机器之心
开源动态7

The Batch: 862 | OpenAI 的重新"开放"

OpenAI 发布自 2019 年 GPT - 2 以来首个开源权重模型 gpt - oss 系列,含 gpt - oss - 120b 和 gpt - oss - 20b,为智能体应用设计,免费使用修改。介绍其输入输出、架构等,还对比了性能表现。

DeeplearningAI