「音频驱动肖像视频生成」共找到 726 篇相关文章
清华开源了一个真的会和你互动的AI课堂,同学老师都是AI,500学生已经验证....
清华大学开源OpenMAIC,这是多智能体驱动的交互式AI课堂。它模拟真实课堂,有多种场景,内置自适应引擎。经500学生验证,数据佳。支持多模型,部署方式多,还集成OpenClaw。
如何定义“人味儿”?——HeartBench评测体系建设实践
在大模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测体系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测体系构建方法论及专家标注管理思考。
VerseCrafter:给视频世界模型装上4D方向盘,精准运镜控物
复旦大学与腾讯等机构提出VerseCrafter,这是通过显式4D几何控制实现的动态逼真视频世界模型,能精准控镜和指挥物体3D运动。它用独特方法构建4D可控世界模型,实验超现有SOTA方法,代码与模型已开源。
“干了20年,没见过这阵仗”:一句话说明存储行情有多火
当前存储行情火爆成‘超级风暴’,产业链各方看法不一。AI算力驱动需求,致产能被挤占,行业从‘周期性短缺’到‘结构性缺货’,市场规则改变,上下游悲喜不同,终端厂商也面临诸多挑战。
鹿明机器人CEO喻超:2026年目标营收过亿,但更关注通用智能的终局
鹿明机器人成立不到一年就凭借人形机器人LUS破圈。2026年其计划建成超100万小时UMI数据采集产能,预期营收过亿,但CEO喻超更关注通用智能终局,认为人形机器人是终极方案。
国产算力解决方案,如何赋能“AI for Science”?
AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。
Runway深夜炸场:一口气发布5大更新,首个通用世界模型来了
主攻AI视频与多媒体生成技术的独角兽Runway发布5大更新,包括旗舰视频生成模型Gen - 4.5、首个通用世界模型GWM - 1等,展示了其在通用世界模型上的野心,刷新了视频生成指标。
这款开源AI卡片笔记,让我果断卸载了Obsidian!
开源君推荐开源项目Blinko,它是自托管、AI驱动的个人笔记工具,主打“快”与“智能”,将RAG技术和LLM能力融入笔记管理,数据自主可控,适合注重数据安全和知识管理的人。
AI Native 的影像公司们,颠覆赛道的机会来了!
文章指出过去50年影像公司通过推动坐标点向「计算」端移动创造商业变量。如今计算突破天花板,带来理解、增强、生成现实三层价值释放,解锁新场景,AI Native影像公司机会巨大。
马斯克造星链,劈柴造算链!英伟达卷到宇宙,谷歌也要上天
谷歌官宣「Project Suncatcher」,要在太空建设可扩展的AI计算系统,预计2027年发射两颗原型卫星。此系统利用太阳能驱动AI,由卫星星座构成,但面临打造星间链路、控制卫星编队等挑战。