大规模数据」共找到 6816 篇相关文章

算法论文8

AST | 西工马龙、邬晓敬等:几何特征知识驱动的代理优化方法

机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。

力学与人工智能
产品应用8

昇腾+鲲鹏联手上招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为规模MoE模型训练扫清障碍。

新智元
算法论文8

联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型

香港学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。

机器之心
算法论文8

工行x上交发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成模型研发新高地。工行数据和人工智能实验室与上海交人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
产品应用8

打通AI4S数据入口:MinerU.Chem让化学文献中的“图片”,从“人类可读”走向“AI可用”

上海人工智能实验室 OpenDataLab 团队发布 MinerU.Chem 技术报告及成果,升级化学文献智能解析能力。它能将化学文献图片转化为 AI 可用数据,解决化学知识机器难用问题,在评测中领先,还将助力 AI4S 发展。

OpenMMLab
新闻资讯8

独家对话晓机器人陶程:具身机器人脑,不必装下整个世界|甲子光年

甲子光年独家对话晓机器人陶程,探讨具身机器人脑。陶程提出控制充分状态,晓用Kairos模型回应世界模型问题,强调行动后果建模,还谈了数据处理、技术风险及应用场景等。

甲子光年
新闻资讯8

多模态文本智能白皮书发布!5能力标准、11个行业案例全解析(附下载)

合合信息发布《文本价值觉醒,赋能智能决策——多模态模型文本智能白皮书(2026)》,提出复杂文本智能五核心能力标准,还通过11个真实行业标杆案例展示技术如何转化文档为决策力。

PaperAgent
算法论文8

ICML 2025 Spotlight | 多模态模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距,视觉推理是核心瓶颈。

机器之心
新闻资讯8

海淀105款模型背后:看这些AI玩家如何抢占内容生产制高点

在北京海淀文化沙龙上,家探讨AI如何重塑内容生产。海淀有105款备案模型,占全国五分之一。快手可灵月入超1亿,AI音乐模型让创作众化,投资人捕捉到AIGC创业潮,新的内容生产秩序正被改写。

量子位
推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 会上,vivo AI 架构师王兆雄分享多模态模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线