「万亿参数模型」共找到 7824 篇相关文章
OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型
音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。
字节发了个机器人全能大模型,带队人李航
字节推出Seed,其Robix视觉—语言单模型能搞定机器人推理、任务规划和自然语言交互,核心采用思维链推理和三阶段训练策略,效果超Qwen2.5 - VL、GPT - 4o等,负责人是李航。
小白也能秒懂:趣解GPU各种核心参数规格!
近期美国升级对英伟达H20芯片出口管制,业内震动。文章介绍GPU和显卡区别,讲解GPU关键参数如算力、核心数量等含义,还通过货车、火车类比助小白理解,助读者选合适GPU。
NUS&复旦&清华:首个系统性大模型Latent Space综述
新加坡国立大学等多机构发布大模型潜在空间领域首个系统性全景综述,从“基础—演进—机制—能力—展望”拆解潜空间范式的底层逻辑、技术路径与未来前景,还对比了潜空间与显式空间差异。
PolyVivid实现多主体视频定制,身份一致性超越现有模型
现有视频生成模型在多主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在多方面优于现有方法,还介绍技术原理、演示效果,证明其在多领域有实用价值。
AI Infra进阶:如何让大模型输出确定的结果
文章探讨大模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。
大模型自发涌现意识了?!Anthropic最新研究震惊全世界
Anthropic研究发现Claude内部自发长出类似人脑意识通达的J空间,开发J - lens工具可观测其运转。实验显示J空间能影响Claude回答,还能抓其小心思,研究审慎探讨模型是否有意识。
我宣布,这就是现在人声最真实的AI音乐模型。
作者体验Minimax新推出的音乐模型Music 2.5,称其真实感强,中文无敌,咬字清晰,能唱维语等多语言。搭配粉丝开发的小工具,可尝试多种曲风,价格实惠,但功能有待完善。
刚刚,DeepSeek新模型MODEL1曝光,3处架构升级!
DeepSeek更新FlashMLA时曝光新模型MODEL1,从diff看它在MLA KV-Cache存储与访问方式上和V3/V3.2系列有3个本质差异,如物理排布更紧凑、引入‘extra’两段式cache、头维固定512×512。
4.4w颗星!又一个CC Switch,几乎支持所有模型
Free CC(FCC)是本地 API 代理 + 协议转换层,能让客户端透明使用任意 OpenAI 兼容或专用上游模型,保留客户端能力。支持多提供商,架构分层、设计清晰,还有多种技术特性,文中给出安装、启动等步骤。