印度本土语言」共找到 1164 篇相关文章

算法论文8

突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知

视觉 - 语言 - 动作模型(VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。

机器之心
开源动态8

告别单兵作战!这个Python语言驱动的AI智能体集群框架火了,30+工具一键调用!

团队开源了Python语言驱动的AI Agents开发框架Strands Agents Tools,提供30+预构建工具,支持多场景,降低开发门槛,为复杂任务调度和系统调用提供解决方案。

开源星探
开源动态8

中科院联合清华等发布视觉语言行动推理模型VLA-R1,让机器人先思考再行动

中科院自动化所、清华和GigaAI联合发布视觉 - 语言 - 行动模型VLA - R1,让机器人先思考再行动。它通过构建数据集教模型思维链,结合监督微调与强化学习提升性能,经多场景测试表现出色。

AIGC开放社区
新闻资讯7

GPT-5最大市场在印度?Altman最新访谈:可以聊婚姻家庭,但回答不了GPT-5为何不及预期

2025年8月8日OpenAI发布GPT - 5引热议。个人消费者多有不满,反馈体验差、性能不强;企业级市场却很欢迎,多家公司已采用。Sam Altman在访谈谈其特性,还聊了职业、家庭、AI发展等话题。

InfoQ
新闻资讯7

GPT-5最大市场在印度?Altman最新访谈:可以聊婚姻家庭,但回答不了GPT-5为何不及预期

2025年8月8日OpenAI发布GPT - 5引发热议。虽受部分用户质疑,如反应慢、回答不准确等,但企业级市场反馈良好。OpenAI CEO Sam Altman在访谈中谈其特性、应用等,还探讨AI对各领域影响及社会问题。

AI前线
开源动态8

清华姚班团队,开源具身智能视觉语言动作(VLA)模型工具箱,打造行业通用技术底座

清华姚班团队所在的原力灵机公司,开源了基于PyTorch的视觉语言动作(VLA)模型工具箱Dexbotic。它能打造通用底座,解决行业研发困境,其预训练模型表现出色,还与Hugging Face合作推出评测平台。

AIGC开放社区
开源动态8

Ilya刚预言完,世界首个原生多模态架构NEO就来了:视觉和语言彻底被焊死

当Ilya断言大模型未来在于架构创新时,中国团队推出全球首个可大规模落地的开源原生多模态架构NEO。它颠覆传统拼接模式,从根上融合视觉与语言,以简洁架构证明架构聪明才是下一代AI竞争力。

量子位
推荐文章8

10万引普林斯顿刘壮最新访谈:架构没那么重要,数据才是王道

普林斯顿大学助理教授刘壮在访谈中指出,架构没那么重要,数据、规模和记忆才是决定AI成败的关键。他认为ConvNet和Transformer性能差异源于训练细节;当前数据集远不够多样;大语言模型有语言空间的世界模型,但视觉空间的还缺失;记忆是瓶颈,智能体只是权宜之计;AI目前还替代不了研究生。

量子位
推荐文章7

从 3 个月业余项目到全球第一语言!Python 之父坦言:当年“将就”的代码,如今全都真香了

Python 之父 Guido van Rossum 在 Python 编程语言峰会上提出‘Worse is better’理论现在是否还适用的问题。回顾早期开发,Python 受 UNIX 精神影响,以‘够用就好’理念快速推出,如今面临新功能开发慢、社区贡献不均等问题。

InfoQ
新闻资讯7

印度裔 AI 负责人删掉 Karpathy 90%遗留代码,马斯克 Robotaxi 终上线!用户体验:不要小费,还可能倒给你钱

当地时间6月22日,特斯拉在奥斯汀启动Robotaxi试点服务。其AI团队核心成员是印度裔阿肖克和德国工程师米兰。技术上精简代码、扩展模型上下文长度,用户体验顺畅,但与马斯克此前设想设计有差异,国内也有多家企业开展此业务。

InfoQ