像素级生成」共找到 2977 篇相关文章

产品应用8

梅涛的视频AI创业,最新产品来了

本文来自量子位,对梅涛旗下智象未来发布的AI视频创作智能体Vivago R1进行深度实测,介绍产品定位、技术架构,分析AI视频赛道分化路线,分享实测体验,探讨AI创作工具发展方向。

量子位
产品应用8

什么Excel这函数那公式,我千问永远一步搞定

市面上能直接交付Excel表格的AI助手少,千问悄悄升解决了这一难题。其新上线的表格Agent功能强大,能对话生成、拍照生成、文件转Excel等,且全渠道免费用,降低了AI使用门槛。

量子位
算法论文8

学会“吃一堑长一智",性能飙升11%!XSKILL让AI积累经验和技能

XSKILL框架让AI像人一样积累经验和技能,将任务技能与动作经验统一到双流设计中,通过视觉接地提取和检索知识,在多个基准测试中显著提升性能,还展现出跨模型迁移性。

AIGC开放社区
8

年度最强AI压轴!谷歌Gemini 3.0下周决战OpenAI,前端要下岗了

谷歌CEO疑似暗示Gemini 3.0下周登场,它或成谷歌重大转折点。其在代码编写、图片生成等方面表现出色,还能一句话生成OS、UI网页。谷歌与OpenAI竞争激烈,巴菲特重仓谷歌股票,业界看好其潜力。

新智元
产品应用8

打造全球首个强化学习云平台,九章云极是如何做到的?

AI正从语言模型走向智能体,强化学习成关键技术,但训练面临困难。2025年6月九章云极发布全球首个工业强化学习云平台AgentiCTRL,实现系统重构,其智能基础设施战略布局领先,具产业赋能优势。

机器之心
开源动态8

3000块钱,这支中国团队把ChatGPT成功的“秘密”用在了机器人训练上

国内穹明智能团队推出千元手持采集系统 UMI ver.2 并开源。该系统精度达毫米、能双臂协同,成本低、部署快。团队认为数据是关键,还计划搭建机器人数据 infra,预计新模型范式很快出现。

AI前线
算法论文8

清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分新范式

音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。

量子位
产品应用8

还在玩AI 3D手办?Gemini 3 Deep Think已能直出STL,可打印实物

推理模型赛道竞争激烈,谷歌 Gemini 3 Deep Think 迎来重大升,能处理科研、工程、多条件约束问题,可将用户要求等建模成 3D 打印实体文件,还能用于多领域科研和工程,欲成科研工程‘第二大脑’。

机器之心
算法论文8

ICCV 2025 | EPD-Solver:西湖大学发布并行加速扩散采样算法

扩散模型成生成任务主流技术,但逐步去噪机制致推理延迟大。西湖大学提出 EPD - Solver 算法,融合三类加速思路优势,可减少积分误差、提升生成质量,还能作插件集成,突破扩散模型速度与质量权衡瓶颈。

机器之心
产品应用8

一场对话,我们细扒了下文心大模型背后的技术

信通院大模型推理能力评估中,文心X1 Turbo获最高“4+”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。

量子位