宝可梦 红/蓝」共找到 4137 篇相关文章

推荐文章8

构建会“说话”和“行动”的 AI:生成式数字人技术与 EchoMimic 实践

在 QCon 全球软件开发大会上,支付李宇明围绕 EchoMimic 介绍生成式数字人进展、技术、应用及研究思路。对比传统数字人,生成式数字人成本低、易控制,但也有技术新、推理成本高的问题。EchoMimic 两版本已开源,经优化推理速度提升。

InfoQ
产品应用7

一个销售数据分析机器人的诞生:看 Dify 如何在 DMS 助力下实现自动化闭环

Dify是低代码AI应用开发平台,但在企业级落地有代码执行和自动化调度瓶颈。本文介绍用“Dify + DMS Notebook + DMS Airflow”架构,以销售数据分析机器人为例,展示构建调度、扩展、运维Agent系统的方法。

阿里云开发者
推荐文章8

Agent性能暴涨90%,刷榜GAIA太容易了~

今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。

探索AGI
算法论文7

AI游戏生成迎来「机制觉醒」:自我进化的玩法设计师

文章指出当前大模型生成游戏存在玩法创新不足、评分虚高等问题。CreativeGame技术关注此问题,通过先写设计文档、激发创意、设计记忆架构等方式,让AI围绕机制持续迭代,探索解释、追踪、迭代的创作范式。

AI科技评论
新闻资讯7

中文互联网“build in public”的新实验,为什么会是AMA?

文章探讨小红书上AMA形式爆火的原因。它与Reddit不同,得益于小红书平权分发、垂直推荐、轻量化设计等特点。AI圈因开源精神成首批用户,AMA为双边提供价值,还让小红书向专业领域拓展。

乱翻书
开源动态8

Meta 悄悄开源了两个惊艳的 3D 重建模型,物体重建+人体重建!

前两天AI圈被Gemini 3 Pro刷屏,Meta却悄悄开源了两个“硬核”项目:SAM 3D Objects从一张照片重建任意物体,SAM 3D Body能从一张照片重建人体网格模型,二者结合构建完整3D场景,且全部开源、商用。

开源星探
算法论文8

迈向原生全模态AI智能体:人大&小红书发布OmniGAIA新基准

中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。

PaperAgent
产品应用8

4K-Agent:将低分辨率图像提升至4K高清智能体

图像超分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将低分辨率图像提至4K高清,在多领域测试表现出色。

AIGC开放社区
开源动态7

Agent Team 实践与架构设计:在约束下构建演进的一个人开发团队

作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统演进性。

phodal
算法论文8

超越免训练剪枝:LightVLA引入微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心