「视觉机器人」共找到 1503 篇相关文章
论文秒变海报!开源框架PosterAgent一键生成顶会级学术Poster
本文介绍开源框架PosterAgent,它能一键将论文转为可编辑的学术海报。相比GPT - 4o,其生成指标优、token使用量少、成本低。研究团队构建评估标准Paper2Poster,实验显示PosterAgent在多方面表现出色。
英伟达新“桌面超算”800GB大内存,满血DeepSeek R1能装1个半
英伟达在Computex大会宣布新办公室落户中国台湾省台北市,还推出多款新品。如面向个人的DGX Station有800GB内存,能跑大模型;面向企业的RTX PRO Server可加速多种用例。此外,还发布新平台、宣布合作等。
Gemini 2.5 Pro登顶三冠王!AI最强编程屠榜,全面碾压Claude 3.7
谷歌Gemini 2.5 Pro(I/O版)横空出世,登顶LMAreana获文本、视觉、编码三连冠,编程能力碾压Claude 3.7。开发者可通过Google AI Studio等使用,其应用演示展现强大实力。
十四年的「管家」局,科沃斯这回把应用定义权交了出来
2026年世界机器人大会上,科沃斯董事长钱东奇提出「未来应用,由用户定义」。回顾过去,从2012年推「亲宝」到2026年发布「八界」,其发展有迹可循。当前,科沃斯推出创新方案和开源生态欲破具身智能难题。
告别通用具身模型崇拜:具身智能走向异构策略编排
当VLA、WAM等机器人控制策略在各自任务中表现出色,如何为子任务匹配合适策略成完成复杂长时序任务关键。RoboHarness解决异构策略协同难题,通过协同调用策略提升成功率。
长得好看又会「看脸色」,这家具身公司不卷「干活」卷「懂你」,天使轮再获数千万战略加注
2026年具身智能转向家庭场景,深穹星核认为面向C端核心是意图理解,推出VLIA模型。其与头部公司合作获意图数据,还与星闪联盟合作推动产品落地,有三层技术护城河,探索长期陪伴机制。
专访贾奎:世界模型不是Demo是生意,10亿融资到位,跨维智能冲刺IPO|甲子光年
甲子光年专访跨维智能创始人贾奎,他提出“Physical Token经济学”,认为物理AI不能只依赖巨量投入和宏大叙事。跨维智能近期完成10亿B轮融资,正冲刺世界模型赛道第一股。贾奎还介绍了公司技术路线、世界模型选择和落地进展。
GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平
香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。
如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26
AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。
Current Robotics 发布 Curr-0:以 Single Policy 实现全身灵巧操作
Current Robotics发布Curr - 0,解决人形机器人移动与操作分离困境。它用Single Policy统一训练,基于HumanEx采集数据,还构建多物理模态交互世界模型,是全栈具身智能基础设施成果。