「图像超分辨率」共找到 2517 篇相关文章
ICLR 2025新成果:文档检索“降本增效”,从此“开挂”
传统文档检索系统处理视觉信息丰富的文档存在瓶颈,ColPali方法直接从文档页面图像生成多向量嵌入,简化流程、提高性能、降低延迟。ColQwen - Omni在其架构上扩展到图文+音频多模态匹配。
马斯克生日惊喜!全球首例Model Y无人「自驾交付」,30分钟见证历史
昨天,一辆特斯拉Model Y从得州超级工厂无人自驾,最高时速115公里,30分钟到车主家门口,完成人类首次工厂到用户的闭环交付。马斯克激动祝贺,此场景复杂度超竞争对手。
Palo Alto5亿美元收购的Portect AI都有什么产品和技术?
2025年4月25日,Palo Alto Networks超5亿美元收购Protect AI,为客户提供端到端人工智能安全保障。Protect AI有两个开源软件ModalScan、LLM Guard和三个平台产品Gardian、Recon、Layer,防护方案完整。
分享一个 OpenClaw 装机必备 Skills 库
腾讯推出代装龙虾公益活动引关注,OpenClaw创始人也转发。GitHub上的awesome - openclaw - skills项目爆火,收录超五千个OpenClaw装机必备Skill,覆盖多场景,还呈现AI Agent发展趋势。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。
2.2K Star!一个开源 AI 桌面客户端,搞定所有 AI 工具的安装、配置与管理!
超60%用户首次尝试AI Agent工具时卡在安装配置阶段。EchoBird是开源AI桌面管理工具,能集中解决AI Agent使用痛点,如一键安装、统一配置等,采用Tauri + Rust架构,有四大应用场景。
确认!DeepSeek多模态AI已经开测
DeepSeek研究员陈小康、陈德里确认其V4视觉模式开始灰度测试。更新后出现识图模式,具备真实图像理解能力。陈小康是多模态研究组负责人,陈德里负责语言模型等核心方向,V4可谓满血归来。
ChatGPT强行上马广告,因为OpenAI真的很烧钱
ChatGPT宣布上线广告引网友吐槽。OpenAI面临财务困境,预计18个月内资金枯竭,2025年烧钱超80亿美元。广告是其商业战略一部分,还推出新订阅档位,未来将多方式促收入增长。
OpenAI收购Windsurf失败
Techcrunch消息,谷歌聘请Windsurf的CEO等成员加入DeepMind团队,Windsurf被Cognition收购,OpenAI收购计划失败。Windsurf此前已筹超2亿美元,曾估值12.5亿美元,吸引OpenAI以30亿美元收购。
马斯克刚关注了这份AI报告
受谷歌DeepMind委托,Epoch发布报告剖析2030年AI的发展。指出训练成本或超千亿美元,公开文本数据2027年耗尽等,马斯克也关注此报告。还从多方面论证发展趋势可延续,且AI将加速多领域科研。