「具身操作评测」共找到 2044 篇相关文章
nnU-Net:医学图像分割的自适应自动化框架
德国癌症研究中心团队提出 nnU-Net 自配置医学图像分割框架,能根据数据集特征自动推导预处理、网络拓扑等策略获稳健分割基线。文章介绍其原理、优缺点、评测案例及 Python 代码实现。
中山大学HCP Lab联合拓元智慧提出高效世界模型DDP-WM,机器人规划效率提升9倍
中山大学人机物智能融合实验室联合拓元智慧提出新型高效世界模型框架DDP - WM。它解耦动态预测,在提升推理速度同时,提高规划成功率,如Push - T任务规划速度提9倍、成功率从90%升至98%。
美团悄悄上线的AI浏览器Tabbit,我觉得它更适合普通人。
美团光年之外团队发布AI浏览器Tabbit,作者认为它比Comet的Agent能力更强,产品完整细节好还免费。与类OpenClaw产品是互补关系,能处理场景式任务,还有很多实用功能,值得一试。
Agent、图像、视频全是大版本升级:春晚还没开,豆包AI就火了
2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含大模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。
巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布
OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在多领域表现出色,但二者也都存在安全风险。
13 万人收藏的 Openclaw 登顶GitHub No.1!附上超绝性价比部署指南!(保姆级)
Openclaw在GitHub上Star数近13万,登上多榜单TOP1。作者介绍用GitHub Codespaces零成本搭建其服务,搭配Kimi K2.5模型和Discord应用,还给出部署步骤、常见问题解决办法及功能演示。
Qwen3满血版上线,第一件事就是把搜索按钮干掉了。
Qwen3-max满血版发布,去掉搜索按钮,因模型能力提升无需手动控制。它具备自适应工具调用能力,能自行判断何时使用搜索等工具,思考过程结构化,跑分接近一线模型。
用人类脑电波教 AI 开车,这位清华 90 后学者直言隐式信号里藏着 AGI 的关键 | 万有引力
清华大学龚江涛团队用人类驾驶员脑电波教会自动驾驶模型“思考”,成果E³AD发表于NeurIPS 2025。龚江涛从计算机转向人机交互,在多段科研经历中积累经验,探索将人类“直觉”赋予AI。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!
当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。
发生在CES的六场对话:来自深圳的 AI 硬件“外卷”
2026年CES上,中国硬件力量大量参展,虽面临地缘政治摩擦和签证障碍,但全球市场对中国AI硬件热情不减。AI硬件呈现新趋势,大厂重定义小玩意,初创公司从数据等方面找生存之道,机器人走向工厂和家庭。