「合成图像数据集」共找到 2957 篇相关文章
千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战
多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。
我们开源了一个可以降低 AIGC 率的模型
毕业季学校查 AI 率,作者为降 AIGC 率,经尝试不同路径后训练出模型。介绍训练数据和过程,包括 SFT、DPO 各阶段,展示改写效果,还开源模型和数据,最后引发对教育检测的思考。
还在为拍视频头疼?AI 一键生成短视频,这工具也太香了吧!
文章介绍开源工具 Pixelle-Video,它能让视频创作变得简单。输入主题,它可自动撰写文案、生成配图、合成语音、添加音乐并合成视频,还支持多种功能和大模型,有多种使用和付费方案。
1.4亿宝可梦玩家,都在给AI免费打工…
1.4亿《精灵宝可梦Go》玩家10年拍300亿张实景图,为Niantic免费收集数据。Niantic用此数据训练VPS视觉定位系统,提升机器人配送效率,还获巨额投资,剥离游戏业务专注空间AI。
具身智能的「Z 世代」,来了
文章与三位具身智能领域的Z世代年轻人对话,他们有不同背景和经历。谭恒楷研究机器人,提出创新模型和算法;吴铭东专注真机强化学习;王乾旭研究蒸馏特征场。他们对AI有独特认知,展现出年轻人的冲劲和思考。
晶圆级芯片和存算一体结合:中科院提出15万tokens/s晶圆级芯片方案丨ASPLOS'26
当前大模型发展对计算硬件需求增长,数据搬运成隐性开销。中科院团队成果Ouroboros实现晶圆级芯片,解决数据搬运问题,虽面临挑战,但性能与能效表现显著,验证了“存算一体+晶圆级集成”路线可行性。
Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局
Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合多种控制信号,实验效果良好。
RL在Agentic Reasoning中的作用:拨开迷雾,看清本质
近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。
那些让你「活人微死」的工作日,终于有救了
当前多数AI工具未打通工作流程,企业微信5.0版本却盘活内部协作、外部市场和数据资产。它有智能搜索、总结、机器人、表格等功能,还实现内部办公、内外连接、数据资产一体化,满足不同企业需求。
对话港理工吕佳欣:如何将一项实验室成果变成一条6500吨级的生产线?
文章是对港理工吕佳欣的访谈,围绕多筒挤压技术展开,探讨从实验室到产业化的过程、挑战及应对方法,还提及工业AI在制造领域的应用,如数据处理、经验转化等,强调科研与工程相互促进。