流式人体动作生成」共找到 357 篇相关文章

推荐文章8

卡帕西点赞Transformer内置计算机!每秒3万Token吞吐,拿下世界最难数独

当前大模型推理顶尖但精确计算不足,Percepta团队在Transformer权重里内嵌可执行程序,通过2维注意力头设计提升推理效率,能在普通CPU上实现每秒3万+Token的流式输出,还精确求解了世界最难数独。

量子位
新闻资讯8

慕了!内存芯片巨头年终奖人均64万;32岁程序员猝死背后公司被扒,曾给39万“封口费”;马斯克曝星舰成本将降99%,商业航天受捧|AI周报

这是一篇AI周报,涵盖多领域热点。如SK海力士发高额年终奖;月之暗面张予彤称Kimi用少量资源开发领先模型;马斯克透露星舰目标、人形机器人计划等;多家公司有新动态,如阿里推AIGC应用、百川发布医疗大模型等。

AI前线
推荐文章8

Agent 如何用搜索?这家最懂 AI 搜索的团队,把踩过的坑都分享出来了

AI时代搜索与传统搜索大不同,人类搜索是静态检索,AI搜索是动态、流式、可追问的。小宿科技作为AI Agent基础设施提供商,分享了为Agent提供搜索服务的经验,包括不同场景下AI应用接入搜索的难点与解决方案。

Founder Park
新闻资讯7

Qwen要做机器人了:林俊旸官宣成立具身智能团队

阿里通义千问大模型负责人林俊旸官宣在Qwen内组建小型机器人、具身智能团队。此前阿里云领投具身智能企业,Qwen系列模型受具身智能公司青睐,此次动作呼应阿里云布局,正值科技巨头加码机器人领域。

机器之心
新闻资讯7

6分钟狂掉750亿市值!苹果发布会发啥了…

苹果发布会开场6分钟市值缩水750亿美元,因Siri更新推迟。此次发布有新设计、AI更新等,但用户和投资者不满。苹果虽有AI动作,如集成ChatGPT、推新框架等,但战略难有重大突破,已考虑与第三方合作。

量子位
开源动态8

MiniMax开源首个视觉RL统一框架,闫俊杰领衔!推理感知两手抓,性能横扫MEGA-Bench

MiniMax开源首个视觉RL统一框架V-Triune,由闫俊杰领衔。该框架通过三层组件设计和动态IoU奖励机制,让VLM能联合学习推理和感知任务。还开发Orsta模型系列,在MEGA - Bench表现出色,且MiniMax多模态布局动作多。

量子位
产品应用7

理想首款AI眼镜,只卖1699元

理想推出首款AI眼镜Livis,售价1699元起,整备重仅36g,续航18小时。它能控车、有头枕音响,还可拍照录像。采用流式智能语音框架,核心亮点是理想同学语音助手,意在构建以车为核心的AI生态。

量子位
算法论文8

斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。

深度学习自然语言处理
开源动态8

机器人视觉语言导航进入R1时代!港大联合上海AI Lab提出全新具身智能框架

香港大学与上海AI Lab联合提出VLN - R1,可将自然语言指令转化为连续导航动作,打破传统链条。它有两阶段训练等创新支柱,在测试中表现出色,小模型性能佳,推动具身智能从数字向具身认知跨越。

量子位
开源动态8

分割一切并不够,还要3D重建一切,SAM 3D来了

深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。

机器之心