「图像到视频」共找到 3241 篇相关文章
谷歌公开全新极限压缩算法:LLM提速8倍、内存占用狂降6倍,精度零损失
谷歌推出全新量化算法 TurboQuant,瞄准大模型键值缓存吃内存、高维向量搜索算力瓶颈痛点,能砍内存、提速度且精度零损失。分 PolarQuant 和 QJL 两步,实验数据表现优异,将改变搜索格局。
显存暴降92%!哈工大为线性注意力开辟了新道路
哈尔滨工业大学等团队发现线性注意力性能不足根源是查询范数丢失等。基于此提出NaLaFormer,在ImageNet - 1K准确率最高提7.5%,超分任务峰值内存降92.3%,为线性注意力发展开辟新道路。
字节开源版Seedance发布,超越Sora 2!
字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。
视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆
2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。
马斯克转帖,发现了一个有趣的中国 AI 初创产品!
马斯克转帖一个搞怪视频,其中互动内容由AI工具Loopit制作。Loopit是北京涌跃智能科技有限公司新推出的产品,介于Sora App和Spielwerk之间,玩法多样,或掀起一波风浪。
融资3100万美元,Atoms让全球70万普通人的「想法」直接变成「生意」
过去两年,AI生产力重心从帮人写代码转向帮人建业务。2026年1月13日,DeepWisdom旗下Atoms获3100万美元融资。Atoms让普通人想法变生意,提供全链路架构,用户跑通三种变现模式,未来将构建AI经济体。
首篇,系统盘点扩散模型高危漏洞!看懂攻击方式和防御体系
随着扩散模型广泛应用,其安全问题凸显。天津大学团队论文系统梳理文生图模型攻击方式、风险类型、威胁场景与防御体系,指出当前防御不足,需建立更体系化防护体系。
每周产业洞察 | AI影视文艺复兴已至,未来24个月内容供给将迎结构性变化
北京AIGC视听产业创新中心位于朝阳区,由多方参与、首创郎园负责运营,通过六大服务平台促进成果转化与场景落地。截至2025年8月已汇聚60余家生态伙伴,首创郎园拓展多地业务。
微软修复严重性评分达 9.9 分的 ASP.NET Core 漏洞
微软发布安全公告,修补 ASP.NET Core 关键漏洞(CVE-2025-55315),CVSS 得分 9.9 分。该漏洞存在于多个版本,攻击者可绕过安全特性,或致权限提升等风险,微软建议升级修复。
当AI开始设计芯片
英国XMOS芯片设计公司正研发GenAI工具,能用自然语言提示配置Xcore处理器硬件特性。这不仅能重塑芯片设计流程,让不同背景的人参与设计,还推动商业模式从卖硬件转向卖确定性,挖掘芯片“时间价值”。