MiniCPM4.0」共找到 2301 篇相关文章

开源动态8

B站出海的强有力支柱:最新开源文本转语音模型IndexTTS-2.0标志零样本TTS进入双维度时代

B站Index团队开源文本转语音模型IndexTTS - 2.0,引发关注。它解决了传统AR模型时长控制难题,实现零样本TTS双维度控制,在多方面表现优异,为B站出海及AIGC应用奠定基础。

机器之心
7

刚刚,「吉卜力狂欢」GPT-4o功臣被挖走!华南理工女学霸曾与奥特曼同台

GPT-4o引爆全球「吉卜力风格」风潮后,其核心成员华南理工学霸Lu Liu与伯克利博士Allan Jabri跳槽Meta。此前他们在OpenAI主导多模态AI研究,与奥特曼同台展示关键功能,此次挖角凸显OpenAI人才流失危机。

新智元
新闻资讯8

中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产

5月25日,华为何庭波在研讨会上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。

AI前线
新闻资讯8

中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产

5月25日,华为何庭波在ISCAS 2026上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片晶体管密度达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。

InfoQ
开源动态8

离谱……面壁让 AI 写了个训练框架,然后它自己训出了最强的 1B 模型:MiniCPM5-1B

面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。

AGI Hunt
产品应用7

第一个用物理做计算原语的大规模生成模型Un-0来了,或将AI能耗降低1000倍?

Unconventional AI 发布首个以物理为计算原语的大规模生成模型 Un-0,由‘模拟耦合振子系统’驱动。其目标是降低 AI 能耗,在 ImageNet 64×64 上 FID 达 6.74,质量接近部分主流传统图像生成方法刚发布时水平。

机器之心
开源动态7

Claude时代终结?LMArena实测DeepSeek R1编程得分超Opus 4,但月暗称其新模型更胜一筹

在闭源模型主导的AI环境下,开源的DeepSeek - R1(0528)在LMArena测试中表现亮眼,编程得分超Claude Opus 4,引发社区关注与讨论。不过LMArena曾被指责偏袒,其联合创始人反驳。此外,月之暗面新模型Kimi - Dev - 72B编程成绩超R1。

AI前线
产品应用8

Claude Opus 4.7炸场,6美元造《我的世界》,临门AGI前强调安全,打工人却更慌了

Anthropic 发布‘目前最强 Opus 模型’Claude Opus 4.7,能力跃升,在多榜单夺冠。写代码、看图表等能力提升,也有网页搜索等能力下降。还展现出游戏开发实力,同步上线Claude Code新功能,加强安全防护。

鲸选AI
产品应用7

英伟达DLSS 4.5来了:Transformer再进化消除鬼影,“拼好帧”最高提至6倍还能动态调节

CES 2026英伟达在中国媒体见面会介绍了DLSS 4.5,它采用“双核心”策略,画质核心用第二代Transformer模型解决鬼影和闪烁,性能核心支持6倍插帧并能动态调节,还推出G - SYNC Pulsar降低动态模糊。

量子位
算法论文8

AI在线强化学习“边做边学”,斯坦福团队让7B小模型性能飙升,甚至超越GPT-4o

斯坦福等团队提出新范式AgentFlow,由四个智能体组成,用在线强化学习持续提升智能体系统推理能力。以Qwen - 2.5 - 7B - Instruct为基座模型的它在多基准测试表现突出,甚至超越GPT - 4o等大模型。

量子位