生成器与验证器」共找到 7037 篇相关文章

算法论文8

登上NeurIPS,Genesis开创无需OCC引导的多模态生成新范式,在视频激光雷达指标上达到SOTA水平

华中科技大学小米汽车提出多模态图像 - 点云联合生成框架Genesis,采用两阶段架构和DataCrafter模块。在nuScenes数据集实验显示,其在视频激光雷达指标达SOTA水平,还提升了下游感知任务效果。

机器之心
推荐文章7

《中国金融机构人才发展培训白皮书(2026)》发布!助力金融机构打造“人 + 智能体”协同的超级员工梯队 | 极客时间企业版

在AI时代,金融人才培养正经历深刻变革。《中国金融机构人才发展培训白皮书(2026)》应运而生,揭示了AI重塑金融人才培养的关键发现,极客邦科技和极客时间企业版也给出了相应方案。

AI前线
7

刚刚,「吉卜力狂欢」GPT-4o功臣被挖走!华南理工女学霸曾奥特曼同台

GPT-4o引爆全球「吉卜力风格」风潮后,其核心成员华南理工学霸Lu Liu伯克利博士Allan Jabri跳槽Meta。此前他们在OpenAI主导多模态AI研究,奥特曼同台展示关键功能,此次挖角凸显OpenAI人才流失危机。

新智元
算法论文8

LiveWorld:视频世界模型新范式,让镜头之外的世界继续演化

现有视频世界模型存在“静态世界假设”,物体离开视野后状态不再更新。阿德莱德大学等研究者提出 LiveWorld,将世界演化观察渲染解耦,使事件在视野外持续推进,并通过实验验证其有效性。

机器之心
开源动态7

Hermes Agent 发布更新 Herald:实时语音 + Agent 之间可以互相通信了

Hermes Agent 更新到 v0.20.0 代号 Herald,增加实时语音对话唤醒词,可验证引用来源可信度,集成签名Webhook,支持代理到代理协议,还有性能安全方面更新,顺应新 Agent 发展趋势。

AI工程化
算法论文7

InfiniteTalk:音频驱动的从口型到全身动作同步方法

近年来视频AIGC推动音频驱动人体动画变革,但传统视频配音局限口部。中国科学院大学提出稀疏帧视频配音范式,推出InfiniteTalk生成器,结合多种技术实现全身动作音频同步,实验表现突出。

带你学AI
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展迅速,现有检测方法难满足需求。最新综述提出「事实保真度验证」目标,梳理出视觉语言双视角的四层检测框架,还分析了检测方法演进、评测指标和数据集,为AI视频检测提供落地地图。

新智元
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合可解释性,还分析评测指标数据集。

新智元
推荐文章8

18 年 SEO 增长经验专家:别再收藏各种 AEO 最佳攻略了,自己动手实验才是做好的关键

18年SEO增长经验专家Ethan SmithLenny对谈,指出网上多数AEO信息不准确,做好AEO要自己动手验证。还分享AEO玩法、SEO区别、优化策略等,强调100%AI生成内容不可行,要优化帮助中心内容。

Founder Park
算法论文7

MoE RL 实战:统一 FP8 全流程训练

SGLang RL 团队等实现 RL 全流程 FP8 训练采样,消除训推不一致性。介绍 FP8 硬件基础、格式等,分析训练难点,定位 KL Loss 异常源于量化原理,验证其在 MoE 模型 RL 场景优势,指出模型规模训推不一致的关联。

GiantPandaLLM