「视频智能体」共找到 4305 篇相关文章
万字总结:如何练就适配人形机器人的可靠「灵巧手」?|GAIR Live
在具身智能崛起时,灵巧手成人工智能落地核心突破口。2025年5月25日相关线上沙龙中,嘉宾围绕灵巧手软硬件、数据与模型、落地应用等交流,探讨数据难题、开源价值、落地挑战及中美差距等。
给机器人打工了一天,我们体验上了AI时代最魔幻的工作。
本文讲述作者公司小伙伴达达体验给具身智能做数据采集工作的经历。具身智能数据获取难,催生数据采集员岗位。达达面试顺利,工作时先觉新奇,后感手腕酸,日薪200 - 250元,凸显AI进步背后普通人的贡献。
60天融资数千万,何泳澔出任CTO!这家黑马冲刺「最后一公里」
本文报道具身智能赛道初创虚时科技,60天内累计完成数千万元融资,前地瓜机器人具身智能算法负责人何泳澔出任CTO。公司押注仿真训练解决机器人落地数据瓶颈,推出全链路闭环仿真训练系统,已获得工业场景订单。
AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年
2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究新架构。小模型崛起、智能体互联标准化、世界模型构建及物理智能落地成趋势。
对话越疆刘培超:春晚隐藏具身选手,却是百亿市值大玩家
今年春晚,越疆科技的六轴协作机器人亮相。创始人刘培超接受专访,披露组建具身智能团队细节。越疆科技目前市值161亿,刘培超以50亿财富登胡润百富榜。他分享创业历程、具身智能布局及对行业看法。
小扎「芒果」生图只输GPT Image 2,没人教它改稿,它自己学会了
Meta推出图像生成模型Muse Image(代号「芒果」)和视频模型Muse Video预览版。Muse Image在文生图榜单排第二,改变画图方式,能自我修正。它与Muse Spark打通,Muse Video文生视频排第3。不过,其@功能有隐私隐患。
马斯克还在卷10秒,中国AI直接掀桌!16秒一镜到底,全球唯二
2026年AI视频圈竞争激烈,硅谷巨头激战正酣,马斯克Grok Imagine上线生成10s视频功能。在此背景下,中国AI的Vidu Q3登场,16s音画直出一镜到底,还支持多种功能,位列中国第一、全球第二。
给 Happy Horse-1.0 讲完戏,我无痛当上导演了
文章聚焦阿里新发布的视频模型Happy Horse-1.0,经测试它在多镜头一致性、人物表现力和视频编辑功能上表现出色,能产出电影质感画面,且价格有竞争力,但物理拟真短板明显,已具影视工业应用潜力。
港大开源ViMax火了,实现AI自编自导自演
香港大学黄超教授团队开源ViMax框架,在GitHub获高星标。它借助多智能体协作实现AI自编自导自演视频,突破主流模型在长视频制作的瓶颈,采用多种策略应对技术挑战,不过在多方面仍有提升空间。
银河通用LDA定义全域数据利用范式,跨本体世界动作大模型开启具身GPT-2时刻
当下具身智能赛道两大流派各有短板,银河通用推出跨本体「隐式世界 - 动作基础模型」LDA - 1B,走自研WAM路线,成果已开源。它打破数据割裂难题,解锁具身智能「GPT - 2时刻」,在多方面展现优势。