多模态架构」共找到 2570 篇相关文章

新闻资讯7

AI圈水太深:OpenAI保密、Meta作弊!国产MoE却异军突起

文章梳理大语言模型发展,从传统稠密架构到稀疏MoE架构,参数从百亿到万亿。介绍OpenAI、Meta等厂商模型,如GPT系列、Llama系列,还提及Mixtral、DeepSeek V3等。指出Meta作弊丑闻,国产MoE模型异军突起。

新智元
新闻资讯8

图灵奖得主杨立昆现场追问:AI 还没越过这 3 道认知墙,谈什么通用智能?

图灵奖得主杨立昆指出AI未越过三道认知墙,即看不懂物理世界、无长时记忆、无推理结构,提出JEPA架构及AMI概念,还建议别卷模型,应卷架构,如探索具身智能等领域。

力学与人工智能
7

AI修真的一年:学者们怎么看“真智能”?|甲子光年

甲子光年在年终盛典对话三位学者,探讨AI“真假智能”。学者们提及强化学习、推理、多模态等技术突破,分析研究路径,还谈选择标准与未来期待,指出AI是工程实践命题,真与假关乎信念选择。

甲子光年
算法论文8

OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式

现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。

带你学AI
算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。

机器之心
开源动态8

阿里Qwen3技术报告核心要点解读!

阿里Qwen3技术报告发布,披露模型架构、预训练及后训练等技术细节。其有密集与混合专家两种模型架构,预训练数据量和语种增多,后训练采用强到弱蒸馏提升性能,各模型表现优异。

PaperAgent
开源动态8

Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密

Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。

AI寒武纪
新闻资讯8

零GPU,世界第一超算!深圳制造改写游戏规则了

中山大学教授带队、深圳制造的灵晟超算登顶全球超算TOP500榜单,零GPU采用纯CPU架构,全链路自研。图灵奖得主评价其为“AI4S新型架构的希望之光”,还在多领域展开应用。

量子位
产品应用7

吃灰 AI 眼镜爆改“交警 Copilot”,函数计算AgentRun 实操记录

作者将吃灰的Meta Ray - ban眼镜爆改成“交警Copilot”,介绍了“端 - 管 - 云”协同框架,分享客户端与服务端开发过程。还探讨用Agent架构和FaaS的原因,指出其在应对需求变化、节省成本等方面优势,最后提及项目待优化处。

阿里云开发者
推荐文章8

大语言模型的解耦:人工智能基础设施的下一轮进化

人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍大语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。

InfoQ