「多模态文本智能」共找到 4448 篇相关文章
Hinton上海演讲:大模型跟人类智能很像,警惕养虎为患
深度学习之父Hinton在上海演讲《数字智能是否会取代生物智能》,指出人类可能是大语言模型,也会有幻觉,但大语言模型优于人类大脑,知识传递高效。他呼吁建立国际社群,培养不夺权的好AI。
WAIC机器人探展:我被全场最靓的崽「Moz1」种草了
2025 年世界人工智能大会上,千寻智能的人形机器人 Moz1 大放异彩。它搭载自研 VLA 模型 Spirit v1,具备强大泛化能力,硬件也有多项突破。千寻智能全栈自研技术,资本持续加码,有望推动具身智能商业应用。
工业异常检测新突破,复旦等多模态融合监测入选CVPR 2025
复旦大学等机构联合发布高精度多模态数据集Real - IAD D³,提出多模态融合检测方法D³M,成果被CVPR 2025收录。该数据集含多类数据,提升检测性能,此前相关工作也被CVPR 2024收录。
Angular 官方的智能体 Skills 助力 AI 编程工具生成现代化的 Angular 代码
谷歌 Angular 团队发布 angular/skills 仓库,含两种智能体 Skills,能让 AI 编程智能体编写现代化 Angular 代码。这些 Skills 针对特定工具设计,开发者可安装使用,社区对此看法不一。
VLA统一架构新突破:自回归世界模型引领具身智能
北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。
不敢信?中国AI国家队出手,刚刚通关了万亿级主战场「地狱副本」
文章指出智能体虽强,但在招标采购等落地场景面临挑战。科大讯飞发布招采智能体平台,提出智能体工厂概念,解决招采痛点。还提炼出四个行业判断,分析其成功原因,标志AI在B端场景走向落地。
InfoDeepSeek:首个开放网络环境下的智能体信息搜寻质量评估基准
上海交通大学与华为诺亚方舟实验室联合推出InfoDeepSeek,它是首个评估真实动态网络环境下智能体信息搜寻质量的基准。该基准有挑战性问题、真实动态环境等亮点,还开展实验揭示智能体行为特性。
7300 人收藏的 PraisonAI,5 行代码即可部署 24 小时 AI 智能体团队!
PraisonAI是开发者Mervin Praison开源的全功能多智能体运行框架,有7.3K+ GitHub星标。它开发门槛低,支持100+大模型,具备完整智能体能力,还能可视化编排、一键接入聊天平台。
鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的新标杆
RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。
迎接智能体的「觉醒时刻」:EverOS全球公测开启Agent Memory自进化序章
随着主动执行型 Agent 爆发,AI 向自我演化智能体跃迁,但现有 Agent 有诸多痛点。EverMind 团队公测专为自我演化智能体设计的记忆底座 EverOS,它依托核心算法与进化引擎,提升任务成功率,解决多项技术难题。