「图像超分辨率」共找到 2517 篇相关文章
AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型
文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。
市值3055亿!摩尔线程敲钟,国产通用GPU第一股来了
国产通用GPU第一股摩尔线程今日敲钟上市,开盘价650元,较发行价高出469%,开盘市值超3055亿元。它88天过会创科创板纪录,将募资用于研发,收入结构转向AI智算领域。
豆包是如何炼成的?字节放出自研万卡训练系统ByteRobust论文
文章介绍字节跳动的LLM训练基础设施ByteRobust。它由控制和数据平面构成,关键目标是获高ETTR。该系统优先快速隔离故障、考量人为错误、控制恢复可变性,已部署超一年,效果显著。
苹果AI选Mamba:Agent任务比Transformer更好
苹果新研究指出,在长任务、多交互的Agent式任务中,基于SSM架构的Mamba在效率与泛化能力上超Transformer。虽Mamba有局限性,但引入外部工具后性能显著提升。
谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%
昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。
刚刚,Gemini 2.5 Pro升级,成编程模型新王
Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示词或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。
AI精准编辑门槛大降:开源框架提升编辑一致性,即插即用
近日,中山大学、香港中文大学等团队发布研究成果ProEdit。它通过对注意力机制和初始噪声潜在分布处理,实现高精度图像与视频编辑,无需训练、即插即用,解决编辑效果与一致性平衡难题。
基于百万亿 Token 的 AI 使用模式分析:趋势、拐点与未来|PPT分享
近期OpenRouter报告《人工智能现状:基于OpenRouter的100万亿Token实证研究》,分析超100万亿个token的真实世界LLM交互数据,弥补LLM实际使用情况证据不足,揭示2024年转折及多方面发现。
70亿美元!全球最大「Token中转站」OpenRouter被收购
据Bloomberg爆料,16日Stripe敲定收购OpenRouter,超70亿美元。其创始人有成功经验,平台凭借统一API聚合AI模型受开发者青睐,业务增长快,已成AI行业“温度计”,Stripe借此掌控AI调用收支口。
80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」
Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。