多模态处理能力」共找到 4484 篇相关文章

推荐文章7

从CLI原理出发,如何做好AI Coding

文章从CLI原理出发探讨AI Coding,介绍CLI产品美学、技术原理,比较Single Agent与Multi Agent,还给出用好CLI写代码的建议,如正确认识AI、学习Prompt工程等,最后提及利用通义万相AIGC实现图像生成。

阿里云开发者
产品应用8

别人在测 Demo,我已经用MiniMax M2.1跑通了整个产品开发流程

作者黄叔用自研产品「降噪」测试 MiniMax M2.1,从 Skills 优化、页面样式、沉浸式交互、智能搜索四个维度检验实战能力。结果显示 M2.1 优势明显,虽有不足,但已能满足多数日常开发任务。

AI产品黄叔
产品应用8

阿里云百炼 AgentScope 基于容器服务的最佳实践,加速企业 AI Agent 应用落地

自 ChatGPT 发布,大语言模型成智能系统核心,AI Agent 兴起。阿里云百炼与容器服务联合发布 AgentScope on 容器服务方案,为智能体应用提供运行底座,介绍了 AgentScope 特性、容器服务能力及部署实践等。

阿里云开发者
算法论文8

人类记忆 vs 大模型记忆,到底差在哪?

这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。

深度学习自然语言处理
新闻资讯7

对话微分智飞高飞:看具身智能如何引发飞行认知革命 | GAIR 2025

雷峰网第八届GAIR大会邀请微分智飞高飞,探讨具身智能在飞行机器人领域应用。高飞指出其与传统无人机本质区别,介绍应用场景、分布式集群技术,还谈世界模型价值、挑战及创业契机,认为具身智能是历史拐点。

AI科技评论
开源动态8

Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在多语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,支持 29 种语言,能高效处理问答等任务,对硬件需求低。

Jina AI
推荐文章7

硬件创业者必看:深谈影石刘靖康

文章是对影石创始人刘靖康的访谈。他谈到上市后团队未松弛,因影像行业苦且目标远大。还阐述做无人机的原因、产品特点,分析不打价格战的理由,指出无人机关键技术和隐形门槛,最后分享对硬件创业等问题的看法。

Founder Park
新闻资讯8

摩尔线程背后大赢家:早期投资人回报已超6200倍

摩尔线程今日登陆科创板,市值达2800亿。其自创立受资本关注,融资超百亿。沛县乾曜早期190万投资增值超6200倍。虽曾遇美国制裁危机,但仍业绩增长,彰显了国产GPU企业的突围能力

芯师爷
新闻资讯7

优理奇机器人完成两轮合计3亿元天使++++轮及天使+++++轮融资,“算法-硬件-场景”三位一体加速具身智能应用落地

优理奇机器人近日完成两轮合计3亿元融资,是半年内第五轮。其坚持“场景驱动”,产品在运动会获奖,量产交付订单超千台。构建完整技术栈,推出标准化机械臂产品,创始人看好具身智能统一发展。

量子位
新闻资讯7

开盘大涨416%,市值近3000亿元,“国产GPU第一股”今日上市

12月5日,“国产GPU第一股”摩尔线程登陆A股,开盘大涨416%,市值近3000亿。它成立五年成国内代表企业,有全栈自研能力。不过,也面临国际巨头、国内竞品、供应链等挑战,且尚未盈利。

芯师爷