多模态智能体」共找到 4168 篇相关文章

开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度

多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位
开源动态8

最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频

今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。

量子位
新闻资讯8

2026「中国 AGI 创新影响力机构 TOP 30」发布

过去一年 AI 行业变化溢出模型层,Coding Agent 铺开,视频生成实现商业变现,具身智能供应链成型。Founder Park 从四维度选出「中国 AGI 创新影响力机构 TOP 30」,涵盖多领域团队。

Founder Park
新闻资讯8

Figure机器人直播100小时打擂台,3秒一个不停分拣13万包裹!

Figure公司F.03机器人直播分拣包裹超100小时,分拣超13万个。10小时人机对决中,人类以不到200个包裹险胜。CEO称这是人类最后一次赢,具身智能飞轮或已过拐点。

新智元
新闻资讯7

米哈游蔡浩宇AI公司首个视频模型曝光了

米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过多模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。

量子位
新闻资讯7

继宇树后,唯一获得三家大厂押注的自变量:具身模型不是把DeepSeek塞进机器人

2026 开年,自变量机器人获字节、红杉 10 亿融资。自变量认为具身智能不是 AI 模型应用,需“生于物理世界、用于物理世界”的基础模型,其有自研成果,还开源模型组织黑客松。

机器之心
产品应用8

中国AI Agent产业化参考范本:斑马口语攻克的四大技术难关

2025年AI产业转折,通用大模型落地难,垂直场景成关键。斑马口语作为垂直落地的AI Agent,突破实时交互、语音识别、内容适龄、多模态呈现四大技术难关,为中国AI Agent产业化提供范本。

机器之心
新闻资讯7

扎克伯格急了!Meta内部文件曝光:宁用竞品,也要废掉祖传系统

Meta的「超级智能实验室」发起内部革命,加速AI开发。扎克伯格豪赌AI,投巨资重组团队、吸引人才。内部文件显示,Meta强制员工用AI,还让员工弃自研系统,用Vercel等平台。

新智元
产品应用8

ChatGTP 发布 Agent 了,但我更推荐 MiniMax

作者受邀内测 MiniMax Agent 新功能,验用其搭建 AI 资讯聚合网站,无需写代码,两小时搞定。该产品全栈开发功能强大,有 MCP 生态,多模态能力出色,对比 ChatGPT Agent 更具优势。

MacTalk
新闻资讯8

李飞飞曝创业招人标准!总结 AI 大牛学生经验,告诫博士们不要做堆算力项目

近日,“AI教母”李飞飞接受采访,指出当前AI繁荣有局限,其初创公司World Labs将攻克空间智能。她回顾ImageNet项目,讲述AI发展历程,还分享创业招人标准、给博士建议等内容。

InfoQ