非抓取式操作」共找到 1221 篇相关文章

开源动态7

Meta 开源 Brain2Qwerty v2:侵入式脑机接口语句解码准确率达到 61%

Meta 近日开源侵入式脑机接口系统 Brain2Qwerty v2,能将人脑想法解码为完整语句,平均单词识别准确率达 61%,远超其他侵入式方案。其采用三阶段深度学习模型,代码和训练数据已公开。

InfoQ
新闻资讯7

成立7个月首发声!百亿美金独角兽万字雄文:攻克LLM推理确定性难题

估值120亿美元的Thinking Machines Lab成立7个月首次公开研究成果,揭示LLM推理确定性的真凶是kernel缺乏批处理不变性。介绍了实现批处理不变性的方法,还通过实验展示其效果及对同策略强化学习的意义。

新智元
新闻资讯7

时代2025 AI百人榜出炉:任正、梁文锋、王兴兴、彭军、薛澜等入选,华人影响力爆棚

《时代》周刊发布2025年度AI领域最具影响力100人名单,众多华人入选,如任正、梁文锋等。文中介绍部分入选者贡献,像任正推动华为在AI多领域布局,梁文锋带领DeepSeek崛起。

机器之心
算法论文8

Yann LeCun生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点

2026年Yann LeCun团队3篇论文展示基于JEPA框架的生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为生成式世界模型提供技术路线。

AIGC开放社区
产品应用7

谷歌把电脑操作能力塞进Gemini 3.5 Flash!自己看屏幕狂点70轮

谷歌将电脑操作能力Computer Use内置进Gemini 3.5 Flash,该AI能通过看屏幕操作电脑,可执行点击、打字等动作。其覆盖网页、桌面软件和移动端,还加入安全约束机制,在基准测试中表现良好。

量子位
产品应用7

WAIC最强亮点:Transformer离线AI大模型已大规模量产,大模型商业比我们想得更快

在WAIC上,RockAI推出Transformer离线AI大模型Yan 2.0 Preview,有视觉感知跃升和自主学习能力两大提升。该公司走Transformer路线,着重场景落地,通过“标杆战略”推动产品量产,未来构想构建“群体智能”世界。

AI科技评论
算法论文8

ICRA 2026|NUS邵林团队提出T(R,O) Grasp:刷新跨智能体灵巧抓取SOTA,实现5FPS动态环境交互

新加坡国立大学邵林团队提出T (R,O) Grasp,这是基于物体—机器手空间关系建模的图扩散架构,有跨智能体统一表征能力,在多种智能体上平均抓取成功率达94.83%,刷新跨智能体灵巧抓取SOTA。

机器之心
算法论文8

告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性?

文章指出LLM推理确定性根源并GPU并发和浮点结合性,而是批大小变化致核函数不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。

深度学习自然语言处理
开源动态8

一站式机器人操作控制框架ManiUniCon

ManiUniCon是多进程机器人控制框架,为操作任务设计。有模块化设计、多机器人支持等特性,介绍了架构、支持的硬件、安装方法、使用方式、开发途径及可用工具等内容。

GitHubStore
开源动态8

谷歌开源结构化数据抽取工具

谷歌开源 Python 库 LangExtract,用 LLM 从结构化文本文档提取结构化信息。它定位精确、输出可靠,针对长文档优化,有交互式可视化,支持多模型,适应多领域,还给出快速开始示例。

GitHubStore