「泛能网」共找到 5216 篇相关文章

新闻资讯8

万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live

2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、长程任务及落地场景等问题。

AI科技评论
推荐文章9

那个拍出神作《牌子》的AI导演,带着他的巅峰之作回来了。

本文是对知名AI影像创作者DiDi_OK的专访,DiDi_OK曾创作全网播放近亿的爆款AI短片《牌子》,此次带来他的巅峰新作《糖果》,访谈围绕创作经历、新作内涵、Seedance 2.5的技术升级以及AI时代的创作本质展开。

数字生命卡兹克
新闻资讯7

仇太深!奥特曼炮轰A社“反人类”

奥特曼在采访中批评AI安全派观点“反人类”,还围绕AI发展相关问题给出见解。如他认为AI会成伟大技术,但社会和经济适应慢;应让人类掌控未来,用AI赋能人类;谈了算力、产品等多方面事宜。

量子位
算法论文8

大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力

现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技
新闻资讯7

谷歌最强大模型付费上线,在DeepSeek开源后被吐槽太贵

谷歌最强模型Gemini 3 Deep Think上线,推理能力强,能将草图变3D场景、搭建游戏。它在多评测基准表现出色,准确率超GPT - 5 Pro等。但仅向Ultra会员开放,月费约1800元,被吐槽贵,开源的DeepSeek-V3.2成冲击因素。

量子位
新闻资讯7

Agent 重构互联网,谁将受益于线上内容的“帕累托效应”?|AGIX PM Notes

文章围绕AI时代展开。在搜索领域,谷歌垄断案法庭主张其向竞争者开放搜索索引数据,这能助对手构建强大索引、补短板。商品服务层面也有80 - 20重构。还提及本周市场动态、AI企业相关消息,如谷歌案裁决、OpenAI成本预期等。

海外独角兽
算法论文8

无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025

KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。

量子位
产品应用8

多模态AI黑马刷榜后再造神器:一个产品搞定图片视频播客生成,自带百种特效,大牛梅涛团队出品

AI大牛梅涛创立的智象未来公司推出vivago2.0(智小象AI),支持图片、视频、播客生成,有上百种特效模板,生图还能自动优化prompt。其依托HiDream - A1,结合HiDream - I1和HiDream - E1能力,团队技术实力强且融资顺利。

量子位
新闻资讯8

DeepSeek-R2尚未问世,微软小模型捡漏称王?6000样本炼出「数学作弊器」!

微软推出Phi-4推理模型系列,参数最多14B,能在本地高性能笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性能超越DeepSeek-R1蒸馏模型,且参数规模更小。文章还介绍了模型特点、训练方法、性能表现及局限性等。

新智元
新闻资讯7

突发!Fable 5.1遭黑客破解,27万字提示词泄露

Fable 5.1和Mythos 5.1发布,Fable 5.1推理成本低32%。但发布几小时后被破解,27万字提示词泄露,曝光了其安全限制、隐私保护等秘密。它工具增加,还破解密码、能完成多种任务,不过也有用户抱怨耗token等问题。

新智元