图像超分」共找到 2992 篇相关文章

8

五年,终于等来Transformers v5

Transformers v5发布首个RC版本v5.0.0rc0,跨越从v4到v5长达五年的技术周期。其日下载量从2万次激增至300万次,总安装量突破12亿次。v5将PyTorch确立为唯一核心后端,聚焦四大维度进化。

机器之心
新闻资讯7

AI七个月突破数学家“围剿”反人类!14位数学家深挖原始推理token:不靠死记硬背靠直觉

大模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得从2%提升到22%,人类团队平均水平。数学家析其推理记录,发现它靠直觉而非死记硬背解题,但也存在缺乏创造力等局限。

量子位
算法论文8

不用头显也能看3D:清华团队把裸眼3D视角扩大到150°

清华大学戴琼海、吴嘉敏团队在 Nature Photonics 发表研究,提出“斯涅尔扫描光场显示(SSS - LiD)”方案,在 150°宽视角下实现高辨率裸眼 3D 显示,还析了裸眼 3D 技术的商业化前景。

DeepTech深科技
算法论文7

手机上实现AI视频实时生成,DiT模型上移动端

扩散变换器在视频生成任务性能强,但计算成本高,在手机上难实用。Snap提出创新优化法,加速视频生成,能在iPhone 16 Pro Max上每秒10帧,不过也存在细节退化等局限。

带你学AI
开源动态8

o3绞尽脑汁仅答对40%的题目,开源模型基本乱猜?MMSI-Bench:多图空间智能试金石

文章介绍了MMSI - Bench,这是用于评估MLLM多图像空间推理能力的VQA基准。它人工构建样本、全面类任务、采用多样真实数据。实验显示MLLM在多图像空间推理有短板,还开发自动化错误析流程助力改进。

量子位
开源动态7

我手搓了一个Seedance 2.0镜Skill:一键生成电影级Prompt,再也不用为提示词发愁了

作者为解决用Seedance 2.0写镜提示词难题,手搓Seedance Storyboard Skill。它能引导用户完成镜细节,输出专业提示词。作者实测4种风格案例效果佳,还介绍了Skill原理、安装使用方法。

AI寒武纪
开源动态8

Qwen新开源,把AI生图里的文字SOTA拉爆了

通义模型家族新开源图像生成模型Qwen - Image,是通义千问系列首个图像生成基础模型。实测其对提示词理解到位,文字渲染高保真。它具备复杂文本渲染、一致性图像编辑能力,在多基准测试达SOTA。

量子位
产品应用8

真·全民AI健康管家来了!实测蚂蚁AQ:追问识药看皮肤,还能连医院接硬件

蚂蚁上线AI健康管家APP——AQ,有百项AI功能,连接5000家医院、近百万医生等。它能追问识药看皮肤,打通硬件,设语音通话。凭借技术和生态优势,实现从技术工具到健康管家的跃迁。

量子位
新闻资讯7

180亿深圳芯片黑马,华为猛下单

4月25日晚,云天励飞公告2024年营收9亿,同比增81.3%,截至4月28日收盘市值180亿。该公司以‘算法芯片化’为基础,在推理算力、行业赋能、消费级业务均有布局,还与华为等合作。

芯师爷
开源动态8

5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!

Codebuff是开源AI编程助手,获5.1k stars。其多智能体架构让不同智能体工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,Claude Code。它免费且上手简单,还能创建自定义智能体。

开源星探