训练数据生成」共找到 5507 篇相关文章

算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成新算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
算法论文8

李飞飞团队新作:简单调整生成顺序,大幅提升像素级图像生成质量

长期以来,AI生图面临潜空间模型细节损耗、像素空间模型结构混乱速度慢的矛盾。李飞飞团队最新论文提出Latent Forcing方法,通过重排生成轨迹,让像素扩散模型找回效率并刷新SOTA。

量子位
开源动态8

训练即服务!让模型训练回归算法语义,150行代码跑通RL

ModelScope团队开源Twinkle框架,采用Client - Server架构,支持20余种算法组件。开发者约150行代码就能编排复杂RL训练循环,底层调度等交给框架。它兼顾易用性与灵活性,有多种特点和优势,代码已开源。

量子位
开源动态8

40.9K Star 数据可视化神器!Json数据处理领域的“瑞士军刀”!

数据驱动场景中,解析复杂嵌套JSON结构费时费力。GitHub上标星40.9K的开源工具JSONCrack,能将JSON数据可视化为交互式节点图,还有转换、格式化等功能,使用简单,应用场景广。

开源星探
算法论文8

Scaling Law再现Agent领域!阿里提出训练新范式:在预训练和后训练之间还需一个Agentic CPT

近年来,大型语言模型向智能体系统进化。但当前主流方法构建智能体不佳,阿里通义实验室团队论文提出智能体持续预训练(Agentic CPT)新范式,开发AgentFounder模型,在多基准测试表现卓越。

深度学习自然语言处理
算法论文8

SceneSplat: 基于3DGS的场景理解和视觉语言预训练,让3D高斯「听懂人话」的一跃

文章引入 SceneSplat,首个在 3DGS 上原生运行的端到端大规模 3D 室内场景理解方法,提出自监督学习方案,构建发布 SceneSplat - 7K 数据集,在多个实验中达 SOTA 效果。

机器之心
新闻资讯7

立足影视文化产业,联动科技,超前布局,推动建设北京视听数据可信空间!首创郎园这样为企业服务——

在2025中国广播电视精品创作大会期间,‘中国视听数据资产化主题研讨’活动举办,‘北京视听数据可信空间’启动建设。该空间是全国首个聚焦大视听产业的可信数据空间,为视听产业数据要素市场化配置助力。

郎园Station
产品应用8

GenAI 退烧后,这家企业正在用 “数据平台” 重构AI2B的底层逻辑

GenAI浪潮下,企业级AI落地难。矩阵起源举办新品发布会,其CEO王龙指出落地瓶颈已从大模型转向私域数据。该司推出MatrixOne和MatrixOne Intelligence,构建“数据智能飞轮”,MOI三层架构可打通数据到业务落地流程,还通过案例展现其解决实际痛点能力。

InfoQ
算法论文7

TransDiff--最简洁的AR Transformer + Diffusion图像生成方法

文章分享图像生成新方法TransDiff,它结合AR Transformer与Diffusion,提出MRAR范式。通过Q&A解答其使用Transformer原因、小Diffusion Deocder效果等问题,还指出它有连续帧生成潜力,将用于视频生成

PaperAgent
算法论文7

Reasoning模型可以Self-Train!

当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。

深度学习自然语言处理