具身操作评测」共找到 2044 篇相关文章

算法论文7

Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了

随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。

机器之心
产品应用8

人形机器人放无人机,还能上天入海!有点过于赛博了吧

中国电信TeleAI团队推出身智能组合,包括首款自研人形机器人TeleBot - M和全自研空海跨域身智能体TeleAqua - Bee。其智传网(AI Flow)解决身智能协同与传输问题,适用于抢险救援等危险场景。

量子位
算法论文7

高精度全身操控!从文本输入生成全身操控物体的动作

物体操控的整体动作生成是广泛应用但极挑战的任务,核心挑战在于手部与身体协调及关节式物体操控精度。香港大学提出协同扩散噪声优化框架CoDA,优化三个专用扩散模型,还采用BPS统一表示提高交互精度。

带你学AI
新闻资讯7

独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资超2亿美元

AI科技评论独家获悉,通用身智能机器人公司无界动力完成天使++轮融资,累计超2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建身大脑,区别于主流架构。还获远景超5亿订单,商业化落地成果多。

AI科技评论
6

苹果应用商店App Store推荐和惩罚机制

App 若想成功出现在Store中,开发者还需要经过上传操作和苹果公司严格的审核。同时,App当上架至App

6

苹果App Store应用商店上传与APP上传流程必看(基础篇)

App 若想成功出现在Store中,开发者还需要经过上传操作和苹果公司严格的审核。同时,App当上架至App

新闻资讯8

让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间

谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位
开源动态8

所有AI工共享记忆!MCP协议杀疯了:100%本地运行,Cursor、Claude都能用

当下多数AI工各自独立运行,会话结束上下文即消失。OpenMemory MCP能解决AI工记忆痛点,实现不同工间共享上下文信息,支持100%本地运行,有跨平台支持等丰富功能。

量子位
产品应用8

微软发布 Agent 安全框架 MAF

微软发布 Agent 安全框架 MAF,它是 AutoGen + Semantic Kernel 的统一继任者。有三层中间件,对 MCP 采样默认拒绝,还加了工审批中间件,编排用图模型,为生产环境安全治理设计。

CourseAI
产品应用7

Gemini桌面客户端终于上线:直接读取屏幕上下文,帮你解读一切!

谷歌推出Gemini的macOS原生客户端,支持全局快捷键拉起和窗口共享。它能突破浏览器限制,基于屏幕内容提供反馈,但目前离真正的桌面助手还有差距,后续有望补齐能力。

新智元