「尺度对齐参考模块」共找到 446 篇相关文章
ICLR 2026 | 救命,手机Live Photo重选封面终于不糊了
vivo 蓝图实验室与南开大学联合发布研究,被 ICLR 2026 接收。该研究定义了 Live Photo 重选封面帧修复任务,提出 LiveMoments 方案,利用原始封面帧作参考提升画质,实验表现优,应用场景广。
国产AI视频炸了!SkyReels-V3三大功能重磅开源,1张图生成逼真视频
昆仑天工SkyworkAI团队开源多模态视频生成模型SkyReels-V3,它能在一个架构内搞定参考图像转视频、视频延长、音频驱动虚拟形象三大核心能力,超越主流商业模型,且真正开源。
让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了
近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。
Sam Altman最新博文!温和的奇点
OpenAI CEO Sam Altman在新博客《The Gentle Singularity》中探讨AI进步远超想象时世界的变化,提及AI将在多方面做贡献,还给出未来几年AI发展预测,指出要解决安全和对齐问题。
人类画了100年的脑图,AI仅用几小时!还绘制出新脑区
加州大学旧金山分校团队提出CellTransformer算法,几小时完成5只小鼠脑图谱绘制,还绘出新脑区。该算法能准确对齐已知脑区,可扩展到多动物数据集,未来有望用于人类大脑及其他器官研究。
奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走
谷歌DeepMind的政治哲学家Iason Gabriel入职9年,发明的对齐框架影响Gemini训练决策。在AGI承诺与AI现实伤害间,他追问AI伦理。但技术部署快,6700亿美元涌入赛道,伦理红线被踩。
AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神
用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。
西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速
扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。
零 API Key也能制作视频,首个完整的开源智能化视频制作工作室
OpenMontage可将AI编程助手变成视频制作工作室,用自然语言描述需求,智能体就能完成视频制作。它能做实拍视频,支持多种参考视频输入,零API Key也能用,还给出了运行步骤和推荐Prompt示例。