「生成式数据」共找到 4590 篇相关文章
ACL 2026 | 赋予视频生成「视觉思维链」:VChain显式建模时空规划与状态演变
南洋理工大学团队在ACL 2026发表VChain框架,引入大模型视觉推理能力提升视频逻辑连贯性。它分三步实现,实验效果超现有方法,还展示视频推理与生成的潜在趋势,为多模态模型协作提供范例。
不愁了!开源智能体Paper2Poster「一键生成」学术海报
2025年5月,滑铁卢大学等团队发布Paper2Poster系统,用大模型将论文自动生海报。它提出PosterAgent多智能体方法,分解析、规划、绘制优化三阶段,生成效果好且开源,不过也存在效率和创意不足问题。
华人团队终结Token危机:扩散模型数据潜力超自回归三倍
最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构
文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来可验证、可演化、可移植的优势。
腾讯云黄世飞:企业如何构建面向未来的 AI-Ready 智能数据基座
本文是腾讯云副总裁黄世飞在腾讯全球数字生态大会的分享,介绍腾讯云AI - Ready数据平台建设进展,涵盖背景挑战、架构创新、生态落地等内容,还提及相关应用实践及未来规划。
ICML 2025|如何凭「自动补全」实现100K生成3×加速?
在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。
AI侵权愈演愈烈!全国首部“AI生成内容合规”标准欢迎参与起草
近期AI侵权频发,暴露AIGC技术下沉应用危害。中国电子商会等联合起草全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》,规范合规要求,还给出四大核心路径解决企业痛点,并阐述标准价值,现公开征集起草方。
不平衡数据下对比学习的理论分析:从训练动态到剪枝解决方案
本文第一作者为新泽西理工学院廖海旭。对比学习在类别不平衡数据下面临挑战,此前研究未考虑其影响。本文构建理论框架刻画训练动态,定量分析少数特征影响,提出剪枝算法增强少数特征学习,实验验证其有效性。
告别先开发后治理:Agent 驱动的数据质量一体化交付
文章指出离线数据开发中数据质量建设面临开发与治理分离的困境,如治理滞后、迭代不同步等。DataWorks引入Data Contracts理念,以YAML Spec形式将质量规则嵌入开发流程,还可借助Agent配置规则,未来将多引擎覆盖、降低门槛并融入IDE。