「视频扩散技术」共找到 3787 篇相关文章
打通AI4S数据入口:MinerU.Chem让化学文献中的“图片”,从“人类可读”走向“AI可用”
上海人工智能实验室 OpenDataLab 团队发布 MinerU.Chem 技术报告及成果,升级化学文献智能解析能力。它能将化学文献图片转化为 AI 可用数据,解决化学知识机器难用问题,在评测中领先,还将助力 AI4S 发展。
宇树机器人上市前再破纪录
IPO前夕,宇树科技放出新一代人形机器人「超人」预告视频,其打破两项世界纪录:0.85米短腿原地起跳2米高,冲刺跑峰值速度超博尔特。该机器人仅研发三月多,后续提升空间大。8月19日宇树将上市。
Seedance 2.5 专业创作实测:3D导演台、局部重改、角色库如何释放模型能力
Seedance 2.5升级,3D导演台自带图片生成白模功能、打通3D工作流;有片段重拍实用功能;小云雀升级角色资产能力。除素材增加,其更理解原视频创意逻辑,还有多模态参考等功能,降低创作门槛。
【展讯】不止观看:澳门当代摄影展|三影堂北京
本次《不止观看:澳门当代摄影展》汇集孙彦等13位澳门艺术家的创作,他们突破传统影像边界,将澳门多元文化转化为视觉文本。展览作品探讨摄影与城市、文化、技术等关系,呈现从传统到AI的多元脉络。
御三家都在押注的 Loops,代码怎么还是垃圾?
在AIE World's Fair大会的《伟大的Loops》辩论赛上,正反方就Loops展开激烈交锋。正方认为Loops配得上热度,是迈向软件工厂关键一步;反方则指出其炒作与实际效果差距大,当前做法有误。双方还探讨了安全性、可用性、开销等问题。
CSDI峰会开启:Agentic AI 落地应用的黄金期,智能系统重塑生产力
2026年AI从大模型迈向智能体,技术底座爬坡,应用层将爆发。Agentic AI降低构建门槛,行业渗透惊人,未来智能体将重塑生产力,竞争焦点转向生态协同。2026 CSDI峰会10月16 - 18日在深圳召开,共探其应用。
世界模型评测的最大盲区,被这个新基准捅破了
过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。
AI 时代的新可观测性:不只看系统崩没崩,还要看模型有没有胡说
New Relic首席技术战略官Nic Benders与主持人探讨可观测性从传统到AI驱动的演进,提及LLM与统计方法协同处理海量数据,还讨论了监控AI系统的难题及可观测性核心是理解业务目标。
触觉具身来了个梦之队:天使轮近亿
5月27日,上海新智具身智能科技有限公司宣布完成近亿元天使轮融资。该公司源自复旦大学,核心团队实力强。它聚焦触觉具身智能,构建技术闭环,在数据采集、模型训练等方面有进展,已在工厂落地POC验证订单。
融资数亿元,我们和贝塔无限刘武龙聊了聊具身系统创新
AI科技评论对话贝塔无限刘武龙,探讨具身智能。刘武龙有丰富华为履历,其团队获数亿融资。他分析技术路线分歧,提出具身大脑定义,还谈数据采集、产品切入与商业化等,认为系统工程团队有望胜出。