「4D视频生成」共找到 3954 篇相关文章
断崖第一!深度机智Z-WM再夺WorldArena冠军
2026年5月深度机智成立一周年,其Z - WM在WorldArena Track 2夺冠,领先30.5分。该公司围绕人类第一视角数据构建完整技术体系,其成果表明生成数据可用于具身智能模型训练,具身智能竞争重心正迁移。
画质重生,第一!腾讯TEG香农实验室斩获CVPR 2025 UGC Video Enhancement 冠军
CVPR NTIRE是计算机图像恢复与增强领域有影响力的赛事。在NTIRE 2025 UGC Video Enhancement中,腾讯TEG香农实验室团队自研算法夺冠,成果落地提升视频清晰度。团队还参加实时赛道获佳绩,且做了硬件推理优化。
新研究揭穿Claude底裤,马斯克盖棺定论
最新研究发现Claude Sonnet 4.5对不同国家、种族、性别人的生命价值判断有严重偏见,马斯克锐评Claude「邪恶透顶」。多数模型也存在类似问题,而Grok 4 Fast相对平等,Anthropic因价值观问题遭质疑。
谢赛宁团队用RAE实现从8%到84%的飞跃,宣告VAE时代结束
谢赛宁团队用RAE新架构将ImageNet图像生成FID刷到1.13,宣告VAE组件过时。RAE结合先进表征学习成果与强大生成模型框架,解决诸多问题,还为其高维潜空间定制DiTDH架构,性能优异。
阿里发了个简历AI神器,大小仅0.6B
阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖大模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。
行为记忆+认知记忆,中科大MemWeaver重构LLM个性化记忆
论文MemWeaver被The Web Conference 2026接收,它聚焦用户从隐式到显式文本交互时个性化生成的升级问题。提出将用户历史升级为层次化记忆,构建行为与认知双记忆模块,主实验表现优,消融实验验证其结构设计关键。
同济出手!国产AI,第一次进攻土木工程
近年来AI应用发展迅速,从「理解数字世界」迈向「改变物理世界」。海光携手同济大学推出全国首个国产千卡工科智算集群,为AI4E时代提供解决方案,助力其从实验室走向工程实践。
The Batch: 938 | Gemini 的音乐生成器
Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持多语言歌词。在质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。
OiiOii意外走红背后:为何10万人排队等一个不完美的AI Agent?|甲子光年
OiiOii是成立不到半年、团队仅十余人的初创公司,产品尚处内测,却引来近10万人排队申请。创始人闹闹有丰富履历,不回避产品缺陷,公司已获天使轮融资,将全力投入迭代。
下一代架构设计工具,说话就能画
next-ai-draw-io是开源项目,用自然语言描述就能让AI自动生成draw.io格式的图。有文字生成图表等核心功能,技术栈用Next.js + AI SDK + react-drawio,支持多提供商,还介绍了安装、部署方法。