「视频换装模型」共找到 8245 篇相关文章

新闻资讯8

牛芯基于UB协议,以IP筑牢生态根基

本文围绕牛芯半导体在UB协议生态中的IP布局展开。UB协议填补国内空白、打破国外垄断,牛芯的PHY IP等取得进展。还介绍其设计理念、架构优势等,如对等架构、单边语义等,以及在内存池、拥塞控制等方面的应用,助力开放算力生态。

芯师爷
算法论文8

Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式

陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。

机器之心
新闻资讯7

知名机器人专家喊话:投人形机器人初创公司的数十亿美元,正在打水漂

知名机器人专家罗德尼・布鲁克斯质疑特斯拉、Figure等公司技术路线,称让机器人看人类视频学操作是‘空想’。他指出触觉数据无技术积累、安全有隐患,预测成功‘人形’机器人未来将大不同,投资难量产。

AI前线
新闻资讯7

Sora 2数手指翻车,奥特曼成第一批「受害者」,被AI玩成最惨打工人

Sora 2虽强大,但数手指测试翻车,模拟场景也有瑕疵。奥特曼成其首批“受害者”,AI生成视频将他玩坏。同时,OpenAI研究员对Sora应用发布存担忧,而奥特曼解释资金投入原因。

机器之心
算法论文8

震撼!AI物理「双修」:亥姆霍兹方程嵌进生成器,伪影当场消失

抢滩6G前夜,香港科技大学(广州)等机构发布PhyRMDM框架,将物理约束与生成模型能力融合,解决传统AI构建无线电地图预测失真问题,成果被顶会ACM MM 2025接收,代码和权重已开源。

新智元
推荐文章7

Prompt的尽头,居然是MBTI。

文章介绍了用MBTI人格优化大模型对话的技巧。论文《心理学增强AI智能体》证明给AI一个MBTI人格很有用,不同人格AI处理任务表现各异,还能组建性格互补的AI团队完成不同工作。

数字生命卡兹克
开源动态8

国产王炸!上海AI Lab开源Lumina-DiMOO,开创多模态理解与生成新范式

上海人工智能实验室等多机构推出多模态生成与理解统一模型Lumina - DiMOO,采用全离散扩散架构。它解决传统多模态架构问题,有全离散扩散建模等四大创新,性能在多基准测试中领先,应用前景广。

AIGC开放社区
开源动态8

阿里开源AgentScope 1.0,多智能体从开发到部署一条龙服务

大语言模型发展下,多智能体系统开发面临诸多难题。阿里通义实验室开源AgentScope 1.0框架,以开发者为核心,有三层解耦架构,模块化设计,还解决安全和管理问题,在工程化特性上优势明显。

AIGC开放社区
产品应用7

人形机器人终于学会洗碗了

Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。

量子位
新闻资讯8

谷歌大脑之父首次坦白!茶水间闲聊引爆万亿帝国,AI自我突破触及门槛

AI界传奇Jeff Dean在「登月播客」深度访谈中,回顾个人成长、Google Brain早期故事及AI未来思考。他揭秘诸多细节,还谈到神经网络发展、注意力机制突破、LLM可解释性等内容,也提及未来五年规划。

新智元