UGC视频增强」共找到 1354 篇相关文章

算法论文8

ACM MM 2025 | 小红书AIGC团队提出风格迁移加速算法STD

小红书AIGC团队提出风格迁移加速算法STD。现有一致性模型在风格化任务有缺陷,文章提出从部分噪声状态出发的训练框架STD,设计轨迹状态库减轻计算负担,引入非对称对抗损失增强风格一致性,实验显示其效果优。

机器之心
产品应用7

苹果憋一年终超同参数 Qwen 2.5?三行代码即可接入 Apple Intelligence,自曝如何做推理

今年 WWDC 大会上,苹果推出专为增强 Apple Intelligence 功能的语言基座模型,含约 3B 参数紧凑型与基于服务器的混合专家模型。经优化可在苹果芯片高效运行,改进工具使用与推理能力,评测显示设备端模型表现优。

AI前线
算法论文8

ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

强化学习获取高质量样本成本高、风险大,现有基于扩散模型的样本增强方法有局限。浙江理工大学马啸讲师和南京大学李武军教授课题组提出 EMCES,将情景记忆机制引入可控扩散模型,提升下游强化学习算法表现,论文已被 ICML2026 录用。

机器之心
新闻资讯7

独家丨华为、联想、富瀚微罕见「同框」,00后空间智能创业者连续获得两轮融资

魔芯科技近日完成新一轮近亿元融资,近两月连续获两轮近亿元融资。其创始人是00后浙大在读博士生。2025年公司研究成果被CVPR2026接收,还发布交互式视频世界模型。采用纯隐式空间表示,在多领域有突破。

AI科技评论
产品应用7

阿里首个世界模型:快乐…生蚝

刚成立一个月的阿里ATH事业群发布全球首个主动式实时交互世界模型HappyOyster(快乐生蚝),它搭载原生多模态架构,有漫游、导演、创造、分享等玩法,目前需邀请码体验。其技术突破让它区别于传统文生视频模型。

量子位
新闻资讯7

半佛怕爆款,三表拒AI,冰汝谢川普

在短视频和 AI 席卷内容行业的当下,今日头条 2025 年深度创作者大会上,驻美记者王冰汝、财经博主半佛仙人、自媒体人三表龙门阵分享了各自的焦虑与坚守。他们谈到爆款、AI 影响、创作模式等问题,展现不同生存哲学。

乱翻书
开源动态8

通过零开销逐层权重卸载技术将SGLang Diffusion wan2.2的推理速度加速60%

文章介绍在优化SGLang对Wan2.2视频生成模型支持时,发现双Transformer架构下第1步和第19步推理慢的问题。通过零开销逐层权重卸载技术,将整体推理速度提升60%,还突破显存墙,且该优化可扩展到其他模型。

GiantPandaLLM
新闻资讯8

GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026

GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、低延迟推理架构、模型自主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。

AI科技大本营
开源动态8

分割一切并不够,还要3D重建一切,SAM 3D来了

深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。

机器之心
新闻资讯8

一个上海AI独角兽爆发了

全球AI圈因MiniMax“发布周”沸腾。新模型MiniMax - M1被视为“性价比新王”,还有新视频、语音模型表现出色。其89年博士闫俊杰带队,在大模型研发上多次做非共识选择,现估值超30亿美元,还推出智能体产品。

芯师爷