「三维场景视频编辑」共找到 2805 篇相关文章
特斯拉下一代金色Optimus原型现身?一双「假手」成为最大槽点
Salesforce CEO发布与金色Optimus对话视频,盛赞其开启物理智能体革命。不过,其高昂价格、“假手”设计引争议。对比Figure机器人精准装碗视频,特斯拉Optimus表现不尽如人意,是否遇麻烦引人猜测。
NVIDIA 推出Rubin CPX,专为AI推理设计的GPU
NVIDIA发布专为大规模上下文AI推理设计的Rubin CPX GPU,性能提升显著,集成视频编解码器和长文本推理处理。新平台算力强,适用于代码生成与视频处理,多家公司将采用,2026年底上市。
Parlant:一个让AI Agent 真正听话的开源框架
AI Agent存在不听话的痛点,Parlant开源框架专门解决此问题。它与传统方法不同,能确保执行规则。具备行为准则、对话流程等功能模块,适用于金融、医疗等场景,已在金融场景落地。
别求Claude了!搭子DuMate杀疯,国产Cowork已帮你把活干完了
Anthropic更新Claude帮助中心,对部分用户启用身份验证,让国内重度用户焦虑。百度智能云上线搭子DuMate,它是桌面级AI智能体,能自动化办公,还更懂国内工作场景,上线后高频迭代。
开源一个非常漂亮的文章配图 Skill
作者将给文章配图的经验做成 `guizang-material-illustration` Skill 开源。它能把文章等内容变成带中文标签解释图,适配多种场景,解决配图难题,还做了多项优化,介绍了适用场景、安装使用方法。
国产模拟芯片迎来升维关键时刻
企业上半年财报显示,2025年模拟芯片正走出周期性低谷。国内厂商面向新兴场景,从多维度创新,向高端领域渗透,但在高端市场、产品矩阵、人才和生态方面与国际企业有差距,需把握创新方向。
第一批人形机器人,已经开始倒闭了
人形机器人被视作“下一个万亿终端”,但2025年赛道先传来倒闭声,如K - Scale Labs烧光融资关门。融资收紧、供应链缺位,技术、成本、场景等难题待解,不过人形机器人未来在多场景有潜力。
全日程公布|谷歌Veo 3惊艳发布后,这场CVPR分享会值得每个AI人「听个声」
谷歌在 I/O 2025 大会发布 AI 视频生成模型 Veo 3,实现音画同步。为让从业者了解 AI 新成果与趋势,机器之心 6 月 8 日将举办「CVPR 2025 论文分享会」,公布全日程、嘉宾及主题,还会直播。
视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理
谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。
Google 新论文离谱到家了,0延迟0成本通用,提升大模型准确率最简单的方法。
Google新论文提出简单提升大模型准确率的方法,即重复提示词,把完全一致的输入连续发2次。主流模型适用,经70项benchmark测试,0场景效果倒退,47个场景准确率提升,且几乎不增延迟、成本。