4D视频生成框架」共找到 3878 篇相关文章

开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位
开源动态8

Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心
7

AI视频杀出一匹“快乐黑马”:把Seedance 2.0挤下榜首,幕后团队成谜

4月7日深夜,AI评测平台公告Video Arena新增匿名视频模型HappyHorse - 1.0,48小时后积分登顶,超过Seedance 2.0。网友猜测其出自中国团队,有线索指向Sand.ai等联合团队或阿里淘天集团。实测表现有亮点,Elo评分合理性存疑。

DeepTech深科技
开源动态8

腾讯混元开源AI绘画新框架:24维度对齐人类意图,让AI读懂复杂指令

腾讯混元团队开源PromptEnhancer框架,通过“思维链提示重写”提升AI绘画文本 - 图像对齐精度,复杂场景准确率提升17%以上。还开源高质量基准测试数据集,为研究提供支撑。

量子位
算法论文8

TPAMI 2026 | 北大彭宇新团队提出CPL++框架,实现视觉定位模型的「自知之明」和「自我纠错」

北大彭宇新教授团队提出CPL及进阶版CPL++框架。CPL用单模态匹配构造伪标签,引入静态验证模块;CPL++进一步自监督升级,具备纠错能力。实验显示,CPL++缩小了弱、全监督方法性能差距。

机器之心
算法论文8

打破资源瓶颈!华南理工&北航等推出SEA框架:低资源下实现超强多模态安全对齐

本文介绍北航彭浩团队的 SEA 框架,针对多模态大模型低资源安全对齐难题,用合成嵌入替代真实数据,突破资源瓶颈。还构建 VA - SafetyBench 评估安全风险,实验验证了 SEA 低资源、高泛化优势。

AI前线
新闻资讯7

马斯克xAI正式入局世界模型,目标:明年搞出个AI生成的大游戏

马斯克的xAI入局世界模型开发,对手是Meta和谷歌等。其从英伟达挖专家,目标是开发先进AI系统,还计划明年底前发布AI生成游戏。不过构建世界模型挑战大,游戏行业有人对此谨慎。

AI寒武纪
产品应用8

Agent、图像、视频全是大版本升级:春晚还没开,豆包AI就火了

2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含大模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。

机器之心
产品应用8

谷歌AI Studio大更新:推出全新“vibe编程体验”,一键生成AI应用,好用到爆

谷歌AI Studio发布全新vibe编程体验,可一键生成AI应用。基于Gemini API,启动界面有功能建议,还有“手气不错”按钮。构建问答游戏不到1分钟,免费且可编辑代码,还有AI建议功能,适合小白。

AI寒武纪
新闻资讯7

不止萌兔蹦迪!狸花猫竖中指,吃奶婴儿开飞机,魔性AI视频让人停不下来

AI正席卷短视频,从“兔子蹦床”到“婴儿开飞机”,魔性剧情吸睛又迷惑,背后是算法驱动的流量生意。虚假内容泛滥,4大YouTube频道已全面AI化,“AI垃圾”或已暗中攻占人类心智,是时候普及“AI防诈”知识了。

新智元