参数壁垒」共找到 787 篇相关文章

开源动态8

刚刚,杨植麟亲自开源Kimi K2.5!国产大模型打架的一天

今天国产大模型热闹非凡,Kimi更新至K2.5版本。它是万亿参数的MoE基础模型,开源且在多项评测表现佳,视觉与编码能力强,还引入Agent Swarm功能,实测展示其解决各类复杂任务能力。

机器之心
开源动态8

百度开源文心4.5系列10款模型,多项评测结果超DeepSeek-V3

今日百度正式开源文心大模型4.5系列10款模型,涵盖不同参数规模。该系列模型在多文本和多模态基准测试达SOTA,多项评测超Qwen3、DeepSeek - V3,还具备三大关键创新,获开发者关注。

Founder Park
新闻资讯8

小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听

小米官宣MiMo-V2家族三款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。

量子位
开源动态8

腾讯混元推出首款开源混合推理模型:擅长Agent工具调用和长文理解

6月27日,腾讯混元开源首个混合推理MoE模型Hunyuan - A13B,参数80B激活仅13B,推理快性价比高。它在多测试集成绩好,尤其擅长Agent工具调用和长文理解,还开源两数据集填补评估空白。

AI前线
开源动态7

凌晨,Qwen又更新了,3090就能跑,3B激活媲美GPT-4o

Qwen凌晨更新,Qwen3 - 30B - A3B有新版本Qwen3 - 30B - A3B - Instruct - 2507。仅激活3B参数,实力媲美谷歌Gemini 2.5 - Flash和OpenAI的GPT - 4o,在多项测试中提升显著,已在魔搭社区等平台开源。

机器之心
开源动态8

连续自回归的dots.tts:小红书开源语音合成模型「基座」

语音合成赛道发展如早期大语言模型,路线未收敛。小红书与上海交通大学合作开源的 dots.tts,是 20 亿参数、全连续、端到端自回归 TTS 基础模型,有准确度高、可扩展等特点,还开源了代码。

机器之心
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。

PaperAgent
新闻资讯7

刚刚,梁文锋被曝史上首次融资!DeepSeek V4彻底摆脱英伟达

外媒曝出DeepSeek正寻求首次外部融资,以不低于100亿美元估值筹集至少3亿美元。V4规模和野心远超前代,参数量达万亿,将运行在华为昇腾芯片上,若成功将脱离英伟达生态。

新智元
产品应用8

全网首测!首款国产GPU「AI算力本」现场上手

新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
产品应用8

Qwen3.8-Max:编程与办公,全面跃升

今日正式发布Qwen3.8-Max,下周将开源其及Qwen3.8 - 27B模型权重。它参数达2.4万亿,在多方面全面提升。开发者可通过千问AI平台获API服务,性价比高。在编程、办公等场景表现出色,用户反馈良好。

千问大模型