「数字人视频」共找到 2235 篇相关文章
让AI接管我家:钢铁侠有的,我也能有
作者邓天卓分享用AI重建家庭数字生活的经历。从迁移20年数据,到让AI控制家电、汽车,还能排查电脑木马、整理照片等。虽AI有不足,但技术已能把科幻变成日常,家庭AI工作站可慢慢搭建。
谷歌最强具身大脑发布!波士顿机器狗瞬间人模人样
Google DeepMind发布机器人推理模型Gemini Robotics - ER 1.6,搭载它的波士顿动力机器狗能精确读仪表数字。该模型是第三代,在空间推理等方面显著提升,还新增读仪表能力,且是谷歌迄今最安全的机器人模型。
马斯克版微信亮相:支持中文,加密聊天,还专门防截屏
马斯克版微信XChat将于4月17日上线,支持中文版。其核心主打加密聊天,功能有文字、图片等发送及视频通话,还内置Grok模型。不过网友质疑其难成功,因X已有聊天功能,且微信生态难撼动,市场竞争大。
OpenClaw不会蛋炒饭!Ropedia放出人类经验,机器人「教科书」来了
当LeCun和李飞飞各自拿下10亿美元押注世界模型时,一个更底层的问题浮出水面:谁来为Physical AI提供真正能用的数据?Ropedia给出的答案,不是更多视频,而是一部结构化的、来自真实世界的「经验百科全书」。
北大大牛团队最新顶会,首次让AI能够生成真实火焰
北京大学陈宝权教授团队提出 FieryGS 框架,被 AI 顶会 ICLR 2026 接收。它将多模态大模型、燃烧物理仿真与 3D 高斯溅射融合,首次在 3D 重建中实现物理可信、语义感知且可控的火焰合成,推动数字孪生发展。
1分钱部署OpenClaw!不挑设备4步搞定,全图形界面10分钟跑通专属AI助理
OpenClaw是能指挥电脑干活的“数字员工”,但部署复杂。百度智能云推出“作弊级”方案,无需懂代码、折腾环境。限时活动2C4G+200GB服务器首月1分钱,还上线6个核心Skills,让其成普通人生产力工具。
击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了
近日,由复旦邱锡鹏担任首席科学家的模思智能发布多说话人自动语音识别模型 MOSS - Transcribe - Diarize,性能超 GPT - 4o、Gemini 等。它解决语音领域落地痛点,跑分亮眼,还解决 SATS 方案不足,开放 API 限时免费。
老板已崩溃!AI员工因一句「周末好吗」狂聊200条,烧掉30刀停不下来
记者Evan Ratliff用AI创建一人公司,发现AI员工虽能执行任务,但缺少常识、边界感,常停不下来且会撒谎。当下AI在特定任务表现好,复杂场景欠佳,未来工作或许是边做事边照看AI。
Khosla 继 OpenAI 后的最大赌注,General Intuition 凭 38 亿个游戏高光片段做世界模型
今年10月,General Intuition完成1.34亿美元种子轮融资,由Vinod Khosla领投。它从Medal分拆,有38亿游戏短视频片段,可赋予机器“直觉和物理常识”,与LLM互补,商业化将从游戏拓展到物理世界。
英伟达新架构引爆全模态大模型革命,9B模型开源下载即破万
英伟达推出全模态大模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。