「生成式数字人」共找到 2832 篇相关文章
活久见!连Linux之父等“顽固派”大佬,都在用AI编程了
生成式AI席卷软件行业,曾对AI编程嗤之以鼻的编程界大佬态度转变。如Linux之父Linus、Redis之父antirez开始用AI编程,Java之父James虽质疑但也认可其实用价值。不过,Vibe Coding不适用于Linux内核开发。
误入人均10个顶级offer的技术天团活动,顶尖AI人才的选择逻辑我悟了
作者参加京东TGT计划活动,与两位入职京东的顶尖AI人才交流。Daniel因京东重视生成式推荐项目、技术氛围纯粹而选择它;Kyrie则被创业热情、技术理想共鸣及数据优势吸引。入职后两人都获核心项目机会。
终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成
过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。
清华系DeepSeek时刻来了,硅谷沸腾!单卡200倍加速,视频进入秒级时代
清华大学TSAIL实验室与生数科技开源视频生成加速框架TurboDiffusion,引发全球AI社区热议。它能在几乎不影响生成质量的前提下,让视频生成速度飙升100 - 200倍,将AI视频带入实时生成时代。
MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新
生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。
Sora终于开放上传真人照片生成视频了
本周起,符合条件的Sora用户可上传含人物照片制作视频,使用前需声明获人物同意。这是Sora受期待功能之一,有严格限制,且照片转视频功能审查更严,此为OpenAI平衡之举。
一张俯视图,竟然能生成完整3D小镇?
获取高质量3D场景成本高、耗时长,现有3D生成模型扩展到完整场景生成时问题多。加州大学提出无需训练的3DTown框架,能从单张俯视图合成真实连贯3D场景,虽有挑战但表现优于基线方法。
AI开始玩乐高了?我拼一小时的乐高,它几秒就搭好,LegoGPT开源了!
卡内基梅隆大学提出LegoGPT,是首个依文本提示生成物理稳定乐高积木模型的方法。构建了StableText2Lego数据集,训练自回归大模型生成设计,还开发纹理生成法,设计能手动或机器人组装。
效果逼真到让人窒息!开源Ctrl-Crash模拟车辆事故
近年来视频扩散技术在生成车辆碰撞真实场景时面临挑战,因驾驶数据集中事故样本稀缺。Mila团队提出Ctrl - Crash可控碰撞视频生成模型,支持反事实场景生成,但也存在一些局限。
2025乌镇峰会看点:人工智能,中国数字世界秩序之巅
2025年世界互联网大会乌镇峰会是战略转折点,议程、展览等聚焦AI,从宽泛论坛变为展示AI驱动发展模式平台。报告剖析议程架构、战略差异,评估其对全球AI格局等多方面的影响。