视觉智能体」共找到 3972 篇相关文章

新闻资讯8

真机RL!最强VLA模型π*0.6来了,机器人在办公室开起咖啡厅

美国具身智能创业公司PI发布最新机器人基础模型π*0.6,新方法大幅提升具身智能成功率与处理效率。其开发的Recap方法从经验数据获训练信号,使模型能执行多项真实世界应用。

机器之心
新闻资讯8

魔法原子登陆硅谷,行业首个「自进化具身大脑」发布

美西4月28日,国内具身智能企业魔法原子在硅谷主办全球具身智能创新大会。会上发布全域世界模型Magic - Mix、新一代灵巧手H01、旗舰人形机器人MagicBot X1,直面行业痛点,还披露全球化战略目标。

AI科技评论
产品应用8

阿里云百炼 AgentScope 基于容器服务的最佳实践,加速企业 AI Agent 应用落地

自 ChatGPT 发布,大语言模型成智能系统核心,AI Agent 兴起。阿里云百炼与容器服务联合发布 AgentScope on 容器服务方案,为智能应用提供运行底座,介绍了 AgentScope 特性、容器服务能力及部署实践等。

阿里云开发者
产品应用7

模力工场 028 周 AI 应用榜:AI “身”觉醒,从工业前线到情感陪伴

模力工场第028周AI应用榜揭晓,上榜应用多来自美国CES展及阿里云通义智能硬件展。AI从虚拟走向物理世界,工业领域机器人成“智能员工”,消费领域有情感陪伴型产品,OiiOii降低动画创作门槛。

AI前线
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
新闻资讯7

4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?

CVPR 2025 官方根据 4 万多名作者 13008 份投稿,总结出计算机视觉热门的三大方向,即基于多视角与传感器的 3D 技术、图像与视频合成、多模态学习(视觉、语言和推理),并介绍了各方向热门原因。

机器之心
推荐文章8

从数据到决策:AI 驱动的 Quick BI 架构设计与实践

阿里云智能集团瓴羊高级技术专家王璟尧,介绍阿里云 Quick BI 从传统 BI 到 AI 驱动的智能 BI 的进化,解析领域大模型与 BI 引擎协同设计等技术权衡,为行业提供可复用技术范式。

InfoQ
新闻资讯8

Claude Opus 4.7连夜突袭:或将抢走全球7亿打工人饭碗!

Anthropic正式发布Claude Opus 4.7,定义为当前可广泛使用的最强Claude模型。其核心升级在复杂任务执行、高清视觉理解和长链路工作流,视觉能力大幅提升,在多方面超越对手,普通用户使用有三大变化。

新智元
推荐文章8

LangChain CEO 再聊 Agent:chat 模式只是起点,Ambient Agents 才是未来

LangChain CEO Harrison Chase 和企业 Agent 平台 Dust 的 CEO Stanislas Polu 在播客中探讨 Agent 发展。他们认为 Agent 是光谱,Agentic 程度更重要;chat 模式只是起点,Ambient Agents 才是未来;还谈及多智能系统及 AI 创业等话题。

Founder Park
开源动态8

ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频

视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。

机器之心