图像超分」共找到 2992 篇相关文章

产品应用8

实测可灵3.0 - 属于每个人的导演时代。

可灵更新至3.0版本,将视频模型能力提升到新高度。它有镜和语言两大升级方向,还升级了Omni模型。可灵3.0适合文生视频等,3.0 Omni擅改视频,二者结合能覆盖多数视频生成场景。

数字生命卡兹克
开源动态8

2026 AI 大模型技术体系综合开源影响力榜单发布,中国开源实力领跑全球

2026年全球AI产业迈入新阶段,开源生态影响力成关键。4月17日CSDN联合多家机构发布《2026大模型技术体系综合开源影响力榜单》,从四大维度、53项细指标评估,呈现开源生态地图,助力中国AI开源跨越。

AI科技大本营
产品应用8

越OpenAI、拿下全球双料第一,“AI吴彦祖”背后大模型SOTA了!

国产大模型MiniMax发布Speech - 02,拿下两项全球权威语音基准测评第一,是榜单前十唯一国产玩家。它拟人、个性化、多样,技术创新,且在多行业落地,全模态布局领先。

量子位
新闻资讯7

OpenAI「自首」!联手MIT证明:ChatGPT用得越多越孤独

OpenAI联合MIT进行四周随机对照实验,追踪981名受试者30万条聊天消息。结果显示,ChatGPT用得越多,人越孤独,信任度越高伤害越深,语音模式长期副作用大,120万用户心理亚健康。

新智元
算法论文8

创智突破:AI首次自主发现106个越人类设计的神经网络架构

创智学院团队发布的AI智能系统ASI - ARCH,自主发现106个越人类设计的神经网络架构,建立“科学发现缩放定律”,实现从“自动化优化”到“自动化创新”转变,还将成果开源推动研究发展。

机器之心
新闻资讯7

The Batch: 920 | Nano Banana 2 在性能/价格比方面实现提升

Google发布Nano Banana 2(正式名称Gemini 3.1 Flash Image),是图像生成系统。它速度快约4倍、成本减半,支持多功能,在多个排行榜中位列前三,以低价接近文字 - 图片排行榜领先位置。

DeeplearningAI
算法论文7

The Batch: 931 | 统一视觉媒体的单一词器

Apple团队开发多维词器AToken,可将图像、视频、3D对象映射到共享token空间,统一处理视觉媒体。它由预训练编码器和解码器组成,经多阶段训练,在多任务上达或接近先进水平,为视觉模型带来通用性。

DeeplearningAI
开源动态8

本周推荐的5个级6的Github开源项目!

本周推荐5个棒的Github开源项目,有基于Nginx的可视化管理面板、全能型浏览器自动化框架、容器命令行版“任务管理器”、命令行知识管理工具,还有GitHub汉化浏览器插件,各有强大功能和特色。

开源先锋
新闻资讯7

这家“小众”赛道的无人驾驶公司,刚刚融了两亿

踏歌智行宣布完成C+轮融资,2亿元,投资方有信泰人寿旗下基金等。国务院推动‘人工智能+’,矿山无人驾驶是关键领域。踏歌智行在露天矿无人驾驶运输优势明显,融资将用于研发和建产业化基地。

AI前线
产品应用7

蚂蚁多模态统一框架Ming-Omni:能看懂世界、会说话、还能画画

文章介绍蚂蚁多模态统一框架Ming - Omni,它可统一处理图像、文本等多模态数据。该框架解决了多模态训练中模态表示差异、收敛速度不一致等问题,采用阶段预训练,能用于图像、音频生成及多模态交互。

CourseAI