「全场景人工智能」共找到 3929 篇相关文章
全球第一!西湖大学成功登顶Science,卷赢同行背后黑科技揭秘
西湖大学一篇论文登顶Science,力压4篇同主题投稿。其成功除科研人员实力,还靠曙光存储支持。曙光为其AI集群升级,提供单节点带宽150GB/s的存储方案,且已大规模落地科研领域。
摆脱遥控器,波士顿动力人形机器人,开始「长脑子」干活了
世界人形机器人运动会引发对人工遥控机器人的争议。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型,展示其自主收纳整理成果,模型构建有流程,成果显著,研发遵循三项核心原则。
最新视觉大模型 DINOv3论文精读(逐段解析)
DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。
机器人也会「摸鱼」了?宇树G1赛后葛优瘫刷美女视频,网友:比人还懂享受生活
宇树G1机器人在2025世界人形机器人运动会夺冠后,赛后“葛优瘫”刷视频的画面走红。此次运动会上,宇树机器人成绩亮眼,不过也出现“肇事逃逸”等小插曲,技术在进步中也暴露一些问题。
AI图像水印失守!开源工具5分钟内抹除所有水印
一款名为UnMarker的去水印技术,能在5分钟内去除市面上几乎所有AI图像水印,谷歌HiDDeN已被完全破解,SynthID被攻破79%。它保持较高图像质量,已在GitHub开源,凭消费级显卡可本地部署。
Figure人形机器人首秀灵巧手叠衣服!神经网络架构不变,只增加数据集就搞定
Figure人形机器人首秀用灵巧手叠衣服,在未改变神经网络架构、仅增加数据的情况下,让原本用于物流场景的它习得新技能,完成了端到端的操作,还实现自然多模态交互。
腾讯开源Stand-In!轻量级身份保留视频生成新突破
生成符合指定身份的高保真视频挑战大,现有方法依赖大参数且兼容性不足。腾讯开源轻量级、即插即用的Stand - In框架,在身份保留文本生成视频任务中性能先进,兼容性强,有广阔应用潜力。
DeepMind 没舍得开源的 Genie 3,被昆仑万维放出来了
过去一周世界模型赛道热度高涨,DeepMind发布的Genie 3未开源,昆仑万维却在8月12日推出自研升级版Matrix - Game 2.0并完整开源。它定位产业化,能让世界模型从实验室走向生产线,还带来盈利模式转变。
首批“数字员工”组团进大厂!7个岗位干爆KPI,提前锁定年度最佳企业级Agent
百度智能云发布7款数字员工,覆盖多岗位,能提升业绩。它们支持“开箱即用”,具备四大核心能力,采用“超强双脑”架构。数字员工可打破传统AI工具局限,真正成为企业生产力。
机器人需求驱动导航新SOTA,成功率提升15%!浙大&vivo联手打造
浙江大学和vivo人工智能实验室团队在ACM MM 2025发表新框架CogDDN。它模拟人类认知,将“双过程理论”用于机器人需求驱动导航,实验中表现优于单视角SOTA方法,为智能机器人技术发展奠基。