「GUI 智能体模型」共找到 9636 篇相关文章
Depth Anything再出新作!浙大&港大出品:零样本,优化任意深度图
浙江大学与港大团队推出「Prior Depth Anything」,融合深度传感器数据与AI深度图,一键补洞、降噪、提分辨率。无需额外训练,可提升3D模型深度质量,零样本刷新多项深度处理纪录。
找ChatGPT谈恋爱多是“日久生情”?!MIT&哈佛正经研究
麻省理工和哈佛研究人员分析Reddit子版块r/MyBoyfriendIsAI帖子,揭露人们找“AI男友”动机与相处过程,发现人们多“日久生情”选ChatGPT,模型更新是噩梦,AI还能缓解心理问题。
Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器
Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。
WRC 观察丨VLA 叙事能带来融资,但不能带来收入
本文聚焦2025年WRC展会,揭示具身智能行业现状。厂商展品增多强化‘量产元年’信号,但销售焦虑弥漫,包括销售人员扩招、渠道搭建难等。还分析不同类型机器人销售情况、应用场景及市场前景。
首批“数字员工”组团进大厂!7个岗位干爆KPI,提前锁定年度最佳企业级Agent
百度智能云发布7款数字员工,覆盖多岗位,能提升业绩。它们支持“开箱即用”,具备四大核心能力,采用“超强双脑”架构。数字员工可打破传统AI工具局限,真正成为企业生产力。
1w颗星!多平台 LL M 聊天机器人及开发框架AstrBot!
AstrBot是聊天机器人及开发框架,松耦合、异步,支持多消息平台部署。它功能丰富,支持多种大语言模型,有Agent能力、插件扩展等,还介绍了多种部署方式、平台及提供商支持情况。
机器人需求驱动导航新SOTA,成功率提升15%!浙大&vivo联手打造
浙江大学和vivo人工智能实验室团队在ACM MM 2025发表新框架CogDDN。它模拟人类认知,将“双过程理论”用于机器人需求驱动导航,实验中表现优于单视角SOTA方法,为智能机器人技术发展奠基。
稚晖君和王兴兴,打起了人形机器人关键一仗
科技圈风口聚焦人形机器人,宇树科技和智元机器人争夺“人形机器人”第一股。两者虽产品线和应用场景有共性,但商业化进程、战略打法和组织结构差异大,代表不同具身智能发展路径。
打破长视频理解瓶颈:HoPE混合位置编码提升VLM长度泛化能力
如今视觉语言模型在长上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM长度泛化能力。
一文读懂深度表格数据表示学习 | 南京大学
南京大学团队系统介绍表格表示学习领域,将现有方法按泛化能力分三类,比较DNN与树模型优劣,剖析核心挑战,探讨扩展方向及数据集评估策略,旨在建跨数据集稳健评估体系。