云栖大会」共找到 5903 篇相关文章

产品应用8

整整21个月,豆包模型正式进入2.0时代!

时隔21个月,豆包模型2.0正式推出。它在多模态理解、企业级Agent、推理和代码能力上有提升,在多个基准测评中达业界最优。实测显示其在编程、数学问题处理上性能出色,性价比也具优势。

量子位
算法论文8

PAS刊发西工张伟伟教授智能流体力学重磅综述论文

西工张伟伟教授团队受主编邀请,系统调研人工智能与流体力学交叉领域进展。通过科学计量学方法,展示发展脉络、现状与前沿方向,分析研究格局、梳理团队,为该领域提供全景图。

力学与人工智能
推荐文章8

模型压缩与量化:让模型走向轻量化落地

文章介绍模型压缩与量化技术,其能在保持性能时降低模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。

机器学习AI算法工程
推荐文章7

模型评估排障指南 | 关于 LaTeX 公式解析

这是模型评估排障指南系列第二篇,聚焦 LaTeX 公式解析。评估难点是解析和比较模型输出与标准答案,无标准方法。lm - evaluation 框架用 sympy 解析准确率约 0.94,还给出缓解问题办法。

Hugging Face
开源动态8

震撼发布!最人体动作数据集 MotionMillion 正式登场

上海交通学研究团队构建高效标注流程,发布最人体动作数据集MotionMillion,含超2000小时、200万条文本 - 动作配对数据。还推出评测体系MotionMillion - Eval,训练70亿参数动作生成模型,刷新SOTA。

带你学AI
算法论文8

拒绝计算“一视同仁”!Elastic Attention:让模型学“看人下菜碟”

现代语言模型用全注意力机制计算复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。

深度学习自然语言处理
算法论文8

7篇顶NeurIPS 2025最佳论文都说了什么?

NeurIPS 2025七篇获奖论文揭示模型思维同质化、推理能力虚幻边界等隐忧,也在注意力机制、神经扩展定律等方面取得物理学层面突破,为AI建立更严谨科学地基。

AIGC开放社区
算法论文8

Transformer祖传设计遭暴击,COLM顶三篇论文发难

COLM 2026上,三篇论文对Transformer关键技术发难。《Cracks in the Foundation》指出长上下文架构选择影响;《Lost in Backpropagation》揭示输出投影层信息损耗严重;《When Fewer Layers Break More Chains》表明层剪枝影响长链推理。

量子位
算法论文8

NUS&复旦&清华:首个系统性模型Latent Space综述

新加坡国立学等多机构发布模型潜在空间领域首个系统性全景综述,从“基础—演进—机制—能力—展望”拆解潜空间范式的底层逻辑、技术路径与未来前景,还对比了潜空间与显式空间差异。

PaperAgent
算法论文8

2026!开年关键词:Self-Distillation,模型真正走向「持续学习」

2026 年刚开始,模型领域研究者达成默契,arXiv 论文高频出现 Self-Distillation。传统强教师依赖范式难适配模型持续进化,Self-Distillation 成破局点。MIT 等机构发布三项研究成果,均用信息差实现模型自驱动升级。

AINLPer