视频智能体」共找到 4279 篇相关文章

算法论文8

协同加速,多机器人协作不再「慢半拍」!软硬一化框架ReCA破解具身智能落地效率瓶颈

佐治亚理工学院等团队推出集成加速框架 ReCA,针对多机协作具身系统,从算法、系统、硬件跨层协同优化,经评估,实现 5 - 10 倍速度提升且成功率升 4.3%,为具身智能落地奠基。

机器之心
新闻资讯8

2026 奇点智能技术大会上海站来袭,解码AI Agent、世界模型与氛围编程等新范式

2026奇点智能技术大会·上海站4月17 - 18日召开。AI正成变革性力量,此次大会升级聚焦AI规模化落地,设十二大专题,有多位出品人与演讲嘉宾带来实践经验与技术洞察,还开放合作与分享者申请。

AI科技大本营
开源动态8

开放全栈!超越π0,具身智能基础大模型迎来真·开源,开发者狂喜

继π0后,具身智能基座模型WALL - OSS正式开源,多项指标超越π0。它是通用多模态具身模型,具良好推理和泛化能力。背后自变量机器人刚完成近10亿A + 轮融资,开源将降低具身智能门槛。

量子位
算法论文8

CVPR 2026 | 让AI视频不再「串戏」:免训练精准控制多段动作,SwitchCraft一招破解逻辑崩坏

随着文本到视频扩散模型发展,AI视频生成有进展,但开源模型处理多事件提示词时存在技术瓶颈。西湖大学团队提出免训练框架SwitchCraft,引入注意力控制机制,入选CVPR 2026,代码已开源。

机器之心
开源动态8

突破视觉仿真算力瓶颈!新一代具身智能仿真框架开源:高吞吐并行高保真渲染助力规模化训练

具身人工智能向以视觉为中心转型,但面临“看得真”和“训得快”难题。清华大学智能产业研究院等提出GS - Playground通用多模态仿真框架,融合高吞吐量并行物理仿真与高保真视觉渲染,成果被RSS 2026录用,将开源。

量子位
新闻资讯8

神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光

神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,现对物理规则和人类习惯的理解与自进化能力。

量子位
新闻资讯8

AI教父辛顿上海WAIC主题演讲:LLM真的理解语言,数字智能极其危险,可以无限复制

AI教父杰弗里·辛顿在WAIC开幕式演讲,对AI发展警惕且悲观。他认为LLM真理解语言,数字智能与生物智能差异大,AI进化快很危险,人类应全球合作研究让AI向善。

AI寒武纪
算法论文8

通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持

LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。

新智元
开源动态7

AI 剪完整条视频,却没看过一帧:背后是所有 agent 都在用的套路

browser - use团队开源的video - use项目能让Claude自动剪辑视频,且AI不看视频帧,靠处理文本完成。这是当前聪明的agent产品通用做法,还给出判断AI agent的三个问题及思路。

AI Reading Hub
产品应用7

写2000字提示词,不如先一键生成3D白模!AI视频创作进入“预演时代”

随着AI模型能力增强,科班人士利用其专业能力在AI视频创作赛道优势明显。updream预演台将影视行业预演工作流引入创作画布,解决了AI视频生成中‘拍什么’和‘怎么拍’的问题,虽有局限但意义重大。

量子位