视频验证」共找到 1763 篇相关文章

产品应用8

NVIDIA 推出Rubin CPX,专为AI推理设计的GPU

NVIDIA发布专为大规模上下文AI推理设计的Rubin CPX GPU,性能提升显著,集成视频编解码器和长文本推理处理。新平台算力强,适用于代码生成与视频处理,多家公司将采用,2026年底上市。

AI工程化
开源动态7

效果逼真到让人窒息!​开源Ctrl-Crash模拟车辆事故

近年来视频扩散技术在生成车辆碰撞真实场景时面临挑战,因驾驶数据集中事故样本稀缺。Mila团队提出Ctrl - Crash可控碰撞视频生成模型,支持反事实场景生成,但也存在一些局限。

带你学AI
新闻资讯7

国家队出手!AI智能体要发「身份证」,首个互联国标将落地

2026年5月8日,多部门联合发布《实施意见》,推动智能体应用,加强AIP等关键国标应用。全国信标委编制的AIP系列国标将公布,现启动AIP协议应用验证先锋计划,招募伙伴开展工作并明确权益义务。

新智元
新闻资讯7

全日程公布|谷歌Veo 3惊艳发布后,这场CVPR分享会值得每个AI人「听个声」

谷歌在 I/O 2025 大会发布 AI 视频生成模型 Veo 3,实现音画同步。为让从业者了解 AI 新成果与趋势,机器之心 6 月 8 日将举办「CVPR 2025 论文分享会」,公布全日程、嘉宾及主题,还会直播。

机器之心
算法论文8

智能体并非越多越好,45%准确率成关键拐点

Google研究《Towards a Science of Scaling Agent Systems》验证“智能体并非越多越好”。在GPT等上实验发现,单个智能体准确率超45%,增加数量会损性能,还揭示工具税、错误螺旋等问题,给出预测公式。

AI工程化
算法论文8

视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理

谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。

AIGC开放社区
算法论文8

真实场景也能批量造「险」!VLM+扩散模型打造真实域自动驾驶极限测试

浙江大学与哈工大(深圳)联合推出SafeMVDrive,将VLM关键车辆选择器与两阶段轨迹生成结合,可在真实域批量制造高保真安全关键视频,用于端到端自动驾驶系统安全性测试。

新智元
产品应用8

锁死一致性!Vidu Q2「参考生」可算来了,新功能强到离谱,APP全面进化

生数科技Vidu Q2「参考生」功能全球正式上线,APP端全面改版。新上线「视频延长」功能,最长扩展5分钟,还在一致性、速度、成本等方面优化,在镜头语言、语义理解等表现出色,APP社交体验好。

新智元
算法论文8

仅保留35% Token,性能反超原模型!快手可灵等用视觉信息引导音频压缩,推理时间直降42%

Omni - LLM计算浪费严重,快手可灵等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token数量,提升性能和推理效率。

量子位
新闻资讯8

陶哲轩最新演讲:AI 不是来抢数学家蛋糕的,是来把蛋糕做大的

陶哲轩在 SAIR 基金会活动演讲指出,数学领域工作方式正被新技术撬动。数学保守、协作难,而形式验证是关键。他主导项目用三个月解决 2200 万代数题,还探讨了 AI 在数学中的应用,认为它应做大蛋糕。

宝玉AI