「数据生成方案」共找到 4874 篇相关文章
AI领域并无真正的新想法,只有新的数据集
作者Jack Morris认为AI虽进步明显,但范式转变级突破不多。大语言模型四次关键突破底层理论早已有之,新在于数据。改变数据比调整模型或算法作用更明显,推动AI进步应找新数据,如YouTube或具身化数据。
Code2Video:全新AI教学视频生成框架,助力高质量教学
生成式模型在生成专业教育视频时受限,新加坡国立大学Show Lab提出Code2Video框架,以代码为中心,由三个协作智能体组成,能通过Python代码自动生成高质量教育视频,代码驱动生成优势明显。
全球首个真实世界具身多模态数据集,它石智航交卷,比特斯拉还早6个月
它石智航发布全球首个大规模真实世界具身VLTA多模态数据集WIYH,将于2025年12月开放。该数据集突破大,特点鲜明,优势明显,其发布填补数据空白,奠定以人为本范式。
自定义轨迹驱动AI视频生成,ATI无需训练适配多种生成模型
字节提出视频生成运动控制统一框架ATI,通过轻量级运动注入器将用户定义轨迹投影至预训练图像 - 视频生成模型潜在空间,实现协调控制。用户指定关键点及路径控制运动,无需重新训练,适配不同架构。
告别传统存算分离,AI时代数据底座迎来全新底层逻辑
文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计算模式等。还探讨底座升级条件、存储挑战、算子价值及未来标准层等内容。
NIPS2025|小红书智创AIGC团队提出布局控制生成新算法InstanceAssemble
当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。
断崖第一!深度机智Z-WM再夺WorldArena冠军
2026年5月深度机智成立一周年,其Z - WM在WorldArena Track 2夺冠,领先30.5分。该公司围绕人类第一视角数据构建完整技术体系,其成果表明生成数据可用于具身智能模型训练,具身智能竞争重心正迁移。
李飞飞团队新作:简单调整生成顺序,大幅提升像素级图像生成质量
长期以来,AI生图面临潜空间模型细节损耗、像素空间模型结构混乱速度慢的矛盾。李飞飞团队最新论文提出Latent Forcing方法,通过重排生成轨迹,让像素扩散模型找回效率并刷新SOTA。
40.9K Star 数据可视化神器!Json数据处理领域的“瑞士军刀”!
在数据驱动场景中,解析复杂嵌套JSON结构费时费力。GitHub上标星40.9K的开源工具JSONCrack,能将JSON数据可视化为交互式节点图,还有转换、格式化等功能,使用简单,应用场景广。
训具身模型遇到的很多问题,在数据采集时就已经注定了丨鹿明联席CTO丁琰分享
具身智能创企鹿明机器人联席CTO丁琰,分享具身智能数据采集现状、困境及新兴采集方式UMI。他强调具身模型问题多源于数据采集,还介绍鹿明产品FastUMI Pro,及其数据采集、模型训练生态。