图像超分」共找到 2995 篇相关文章

产品应用8

登顶 Arena!MiniMax 最新 Speech-02 模型屠榜:越OpenAI、ElevenLabs,人声相似度99%

近期TTS模型领域发展火热,众多机构纷纷发力。MiniMax推出的Speech - 02模型登顶Arena榜单,在字错率和相似度等指标上表现出色,具备拟人、个性化、多样性特点,性价比高,还创新架构解决了现有痛点。

AI前线
算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上SOTA模型,还在快手业务场景成功应用。

机器之心
推荐文章7

Patreon 年度回顾中的架构经验

2025年Patreon工程团队在为千万付费会员推新功能时重建底层设施。其年度回顾详述12个项目,提炼韧性迁移、数据模型重构、布式系统一致性权衡三大架构主题,还享多项目实操经验。

InfoQ
开源动态7

国产开源大模型:再见9月,你好10月~

9月国产大模型持续开源,涉及DeepSeek、Qwen、百度等。如DeepSeek-V3.1缓解语言问题、优化Agent能力;阿里Qwen系列开源10个模型;百度Qianfan-VL增强领域能力等。还展望10月新模型开源。

PaperAgent
产品应用7

一家营收千亿美元的公司,如何回应 AI 落地的策略问题

2025年9月19日,Qwen3和DeepSeek v3.1上线Amazon Bedrock。该产品秉持“Choice Matters”理念,为不同业务选适配基础模型,上架二百余款模型。亚马逊云科技副总裁总结选模型要点,其策略影响AI落地进程。

InfoQ
开源动态8

GitHub 1.3k 一款能“填色回忆”的神器:DDColor 让老照片鲜活又逼真

DDColor是阿里达摩院团队提出的新一代图像自动着色模型,基于双重设计,能实现高保真、真实感强的黑白图转彩色图。它兼容多种类型图片,有诸多核心功能,相比传统模型优势明显,应用场景广泛。

小华同学ai
算法论文8

人类创造力的核心机制,AI已经开始掌握了 | 北大CogSci 2025(Oral)

北大团队论文揭示AI开始掌握人类创造力核心机制,提出IEI框架量化评估AI组合创造力。研究发现GPT - 4等在创意理解普通人,框架优化可提升AI创意输出质量,论文被CogSci 2025收录。

量子位
新闻资讯8

Google DeepMind 联合创始人、首席 AGI 科学家:如何构建一个让 AGI 有助于人类繁荣发展的世界?

Google DeepMind联合创始人、首席AGI科学家Shane Legg在播客中称AGI可能2028年到来。他探讨AGI定义、伦理等,认为其多层级,还指出社会模式或改变,部工作将受影响,也强调利用好它或带来黄金时代。

AGI Hunt
开源动态8

ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana

ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。

量子位
算法论文8

只要9美元!LoRA+强化学习,DeepSeek 1.5B推理性能暴涨20%

南加州大学团队基于LoRA的强化学习训练1.5B推理模型,在AIME 24测试上性能提升20%,成本仅9美元。开源Tina模型结合三大关键技术,与SOTA模型相比竞争力强,研究者还对其有效性提出假设。

新智元