图像到三维」共找到 2529 篇相关文章

开源动态8

年轻人的第一个爱马仕

AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星数超35000。作者写76页《Hermes Agent从入门精通》,介绍其设计思路、使用方法等,中英文版可在GitHub免费下载。

花叔
产品应用8

一张图生成雕刻级 3D 模型,效率拉满,绝了!

Hi3D是商品级3D模型生成工具,在Hugging Face上连续三周霸榜下载第一。其2.0版本能自动补全不可见结构、消除环境光干扰、优化人像细节。操作简单,还有多种玩法场景,官方还提供兑换码福利。

开源先锋
新闻资讯8

阿里权力交接全解读:9人出局、蒋凡上位、3800亿豪赌AI—投资者必读深度研报

过去两年,阿里经历权力重组,合伙人缩减,蒋凡上位,吴泳铭押注3800亿AI。从“分封制”回归“集权制”、从运营驱动转向AI驱动,本文拆解变革,给出投资判断,分析各业务板块营收、竞争力,推演未来情景并提示风险。

AI Reading Hub
产品应用8

中国AI音乐,悄悄把全球第一拿走了

昆仑万维Mureka V8登顶Artificial Analysis音乐模型榜,人声、器乐双料第一。实测显示其创作能力强,能生成完整歌曲。昆仑万维迭代迅速,V9将登场。AI音乐赛道“东升西落”,国产模型崛起。

量子位
算法论文8

CVPR 2026 | 让AI视频不再「串戏」:免训练精准控制多段动作,SwitchCraft一招破解逻辑崩坏

随着文本视频扩散模型发展,AI视频生成有进展,但开源模型处理多事件提示词时存在技术瓶颈。西湖大学团队提出免训练框架SwitchCraft,引入注意力控制机制,入选CVPR 2026,代码已开源。

机器之心
算法论文8

港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026

扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。

AI科技评论
新闻资讯7

安全的下一个好赛道,非常值得研究

近几年机器人发展火爆,摩根士丹利预测2050年产业规模或超5万亿美元。但机器人领域安全复杂,研究团队用CAI框架对三款消费级机器人渗透测试,揭示严重安全问题,且行业整体对安全无知。

AI与安全
产品应用7

阿里千问你别太荒谬!连漫画PPT都能一键生成?我以前那些夜真是白熬了

阿里千问发布AI PPT生成工具Qwen AI Slides,从内容结构视觉配图全包。实测显示,其语义理解能力不错,文本渲染在简单字体表现好,排版有小瑕疵,适合课堂展示等场景。

量子位
算法论文8

治好多模态近视和走神!上海大学去偏干预显著提升模型性能

多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
产品应用8

大模型API的大众点评来了:7×24小时实测,毫秒级延迟智能路由,选API必备

清程极智推出的AI Ping像大模型API领域的大众点评,用7×24小时实测数据为开发者提供参考,解决信息差和重复劳动问题。它有持续评测榜单、智能路由匹配等功能,还统一了API度量衡,推动选型从经验走向数据驱动。

量子位