分层赋能」共找到 5162 篇相关文章

算法论文8

任意骨骼系统的模型都驱动?AnimaX提出基于世界模型的3D动画生成新范式

传统3D动画制作依赖骨骼绑定与关键帧编辑,成本高。现有自动化方法有局限。北京航空航天大学团队提出AnimaX框架,结合视频扩散模型与骨骼动画优势,支持任意骨骼拓扑,生成动画质量高、速度快,泛化力强。

机器之心
产品应用7

3D领域的NanoBanana也来了,万物皆可用嘴操控。

3D领域的hyper3D推出Rodin Gen - 2,是首个用嘴编辑3D模型的AI 3D产品。用户可上传三方模型修改编辑,还图生3D。用嘴改3D做局部可控修改,适合专业生产管线。

数字生命卡兹克
产品应用7

比爆火的OpenClaw更王炸?这台百元神机,已经让AI长出手脚帮你打工了

英伟达DGX Spark因内存供应紧张涨价,4万的成本让预算敏感者望而却步。阿里云无影个人云超算服务性价比高,按量付费百元左右。其AgentBay让AI获“手脚”,还具OpenClaw没有的力。

AI寒武纪
开源动态8

3.8K Star!港大开源 AI 量化神器:一句话生成量化策略,普通人也玩懂!

港大开源的Vibe - Trading在投资圈火了,它是AI驱动的多智体金融工作台,将自然语言请求转化为交易策略等。有多智体协作架构,内置64个金融技、29个智体团队预设,提供4种安装使用方式。

开源星探
开源动态8

给几何图片写标题就让AI更聪明,UIUC发布高质量可泛化几何数据集

随着多模态大语言模型在视觉问答等任务广泛应用,其几何推理力成研究热点。现有方法泛化力有限,UIUC团队提出Geo - Image - Textualization框架,发布GeoReasoning - 10K数据集,提升模型几何推理表现。

机器之心
产品应用7

企鹅终于跟进了:OpenClaw 接入企微,一个企微群,我管住了 Win、Mac、手机,还@不同AI 专家

微信不开放,企业微信却允许 OpenClaw 接入。其接入简单,还具特色机制与主动性通知。文中介绍了 OpenClaw + 企微等玩法,如多 Bot 群聊、跨设备控制等,最后给出企微接入 OpenClaw 保姆教程。

AI进修生
产品应用7

产品经理也“开发”需求?淘宝信息流从需求到上线的AI端到端实践

淘宝推荐信息流业务被“需求多、技术栈杂、协作慢”困扰,上线周期长。WaterFlow这一AI驱动的端到端开发实践,让部分需求两天内上线,产品经理也参与。文章揭秘其落地及协作模式改变,还展示了实践效果。

阿里云开发者
产品应用7

我用“悟空”做了应聘和OPT Skills,预测上班和创业成功率丨龙虾OPT创业笔记

钉钉发布全球首个企业级 Agent 平台“悟空”,它是AI产品进入下一个时代的探索,接入多平台真实数据,操作公司流程。通过开发者应聘、跨境电商、知识博主等场景案例,展现其力,还预测创业成功率,解决企业使用AI的安全痛点。

鲸选AI
产品应用7

小哥硬核手搓AI桌宠!接入GPT-4o,听得懂人话还互动,方案可复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,手搓AI桌宠Shoggoth,接入GPT - 4o,与人互动。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
算法论文8

首创像素空间推理,7B模型领先GPT-4o,让VLM像人类一样「眼脑并用」

当前主流视觉语言模型(VLM)依赖文本token间接翻译视觉信息,缺乏直接视觉操作力。滑铁卢大学等团队提出「像素空间推理」范式,让VLM像人类一样「眼脑并用」,在四大视觉推理基准测试中,7B的Pixel - Reasoner表现碾压GPT - 4o等。

量子位