具身感知」共找到 1280 篇相关文章

算法论文7

高精度全操控!从文本输入生成全操控物体的动作

物体操控的整体动作生成是广泛应用但极挑战的任务,核心挑战在于手部与体协调及关节式物体操控精度。香港大学提出协同扩散噪声优化框架CoDA,优化三个专用扩散模型,还采用BPS统一表示提高交互精度。

带你学AI
产品应用8

微软发布 Agent 安全框架 MAF

微软发布 Agent 安全框架 MAF,它是 AutoGen + Semantic Kernel 的统一继任者。有三层中间件,对 MCP 采样默认拒绝,还加了工审批中间件,编排用图模型,为生产环境安全治理设计。

CourseAI
新闻资讯7

谷歌神秘模型Kingfall泄漏!

近日,谷歌AI模型Kingfall在AI Studio平台短暂开放后意外曝光。它备多模态处理能力,上下文窗口6.5万个token,有两种模式。生成SVG矢量图能力超Claude 4,份猜测不断。

AI工程化
产品应用8

人手一个顶级家教!OpenAI深夜重磅:ChatGPT「学习模式」上线

OpenAI推出ChatGPT「学习模式」,旨在支持真正的学习。该模式从答案机变导师,通过定制指令实现智能教学,有交互式提示等特性,测试反馈积极,未来还会有更多功能。

AI寒武纪
开源动态8

斩获22K star!再见重复劳动,微软AI开源智能办公机器人来了!抓紧用起来

微软推出视觉自动化神器`OmniParser`,上线GitHub获22K star。它重新定义人机协作,有三大能力、五大自动化杀手锏,适用于六大实战场景,还给出速成指南,与同类方案相比优势明显,正重塑办公范式。

小华同学ai
新闻资讯8

北京798多觉工场开幕首展·《觉:数字艺术在中国》

2026年6月,北京798多觉工场开幕,首展《觉:数字艺术在中国》同期亮相。这是全球首个以“多觉艺术”为核心理念的实体空间,汇聚27位艺术家50余件作品,涵盖多种媒介,让观众调动感官,实现“艺术平权”。

MANA新媒体艺术站
算法论文8

AI 如何讲好一个多人故事?首个支持多角色互动的3D场景叙事系统

首尔国立大学提出全新框架,能生成虚拟动态场景并支持多角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。

带你学AI
推荐文章8

逆向工程:ChatGPT 的记忆是如何工作的

文章是工程师eric对ChatGPT记忆系统的深度逆向工程和技术实现推测,详细拆解‘可保存记忆’和‘聊天历史’,分析工作原理、实现方案,探讨其对提升用户体验的作用,认为‘用户洞察’是关键。

AI寒武纪
产品应用8

一夜之间,Claude成我同事了

今天凌晨,Claude Code 迎来重磅更新 Claude Tag,可让 Claude 以团队成员份加入用户团队,在 Slack 平台使用。它备持续记忆、主动介入等能力,有多人共享、持续学习等优势,企业客户可试用。

机器之心
7

Cursor SDK正式发布,“cursor” inside!

四月最后一天,Cursor正式发布TypeScript SDK,将智能代理运行时打包成可编程组件,跳出编程工定义。它提供完整开发套件,支持双模部署,已有公司用其做三件事,还包含关键部分,Composer模型开放有战略价值。

AI工程化