可灵 3.0」共找到 6053 篇相关文章

新闻资讯7

CVPR 2025 Tutorial:从视频生成到世界模型 | MMLab@NTU团队&快手等联合呈现

图像生成普及,视频生成也有高质量发展,、Sora等模型不断拓宽边界。CVPR 2025 Tutorial将探讨视频生成能否成世界模型桥梁、具身智能核心能力等问题,汇聚一线研究者分享。

量子位
开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
算法论文8

ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与移动物体交互动作生成新框架

北大团队在ACMMM 2025发布InteractMove,首次提出含移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据集与创新框架,在多指标领先,代码与模型已开源。

机器之心
算法论文8

GRPO训练不再「自嗨」!快手 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。

机器之心
新闻资讯7

SpAItial发布超逼真3D空间基础模型

德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,基于文本或图片生成3D场景,在多领域有革新能,虽有竞争,但未来有望推动AI三维突破。

AIGC开放社区
开源动态8

从「会表演」到「更会演」:KlingAvatar2.0让数字人拥有生动

近日快手团队发布 KlingAvatar2.0 技术报告,数字人能‘生动表达’。它有三大创新技术,如时空级联框架等。实验显示其生动性大幅提升,性能超竞品,推动数字人在多领域规模化应用。

机器之心
算法论文8

仅保留35% Token,性能反超原模型!快手等用视觉信息引导音频压缩,推理时间直降42%

Omni - LLM计算浪费严重,快手等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token数量,提升性能和推理效率。

量子位
产品应用7

自写驱动越狱!Gemini 3 Pro零败绩通关宝梦:效率碾压前代8倍「Agent进化太快了」

在全自动《宝梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。

AI寒武纪
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型小如手机App

腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位
新闻资讯7

阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒

4月27日,阿里巴巴视频生成模型HappyHorse 1.0开启灰测,全球专业创作者和企业级客户在官网和阿里云百炼平台注册使用,大众用户在千问App体验。官网720P视频生成刊例价0.9元/秒,专业会员包月叠加限时折扣后低至0.44元/秒。

AI前线