「图像超分」共找到 3000 篇相关文章
创智&交大发现AI能动性新规律, 78样本胜GPT5实现软件+科研自动化
上海创智学院和上海交大刘鹏飞老师团队发现AI能动性新规律,LIMI仅用78个样本就超越GPT - 5达14.1%,提出能动性效率原则,即AI能动性不仅源于数据丰富性,更来自战略性构建,为AI系统开发开辟新路径。
社区供稿丨MiniCPM-V 4.5 技术报告正式出炉
上个月开源的多模态模型 MiniCPM-V 4.5 广受好评,今日其技术报告出炉。报告从架构、数据和训练三方面探索高效路径,提出三大技术,使模型在多任务上突破,小参数规模下性能和推理速度佳。
「一页纸」吃透产业链之:人形机器人,Figure链与特斯拉Optimus链
文章聚焦人形机器人,分析其产业处于量产落地拐点,2025 - 2026年是关键期。介绍产业链上中下游情况,指出面临的软硬件挑战,还提及市场规模、主要参与者,重点关注Figure与特斯拉Optimus产业链。
挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因
随着大语言模型发展,多智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。
字节Seed最新版原生智能体来了!一个模型搞定手机/电脑/浏览器自主操作
字节Seed发布最新版原生智能体UI - TARS - 2,采用All in one原生设计,表现优于Claude和OpenAI Agent等。它通过多轮强化学习,解决智能体操作图形界面的四大难题,在多测试中表现出色。
Github 1.8K star厉害!!有了这个办公AI神器,效率飙升!
Speakr是完全自托管的AI会议助手,能将音频转文字、生成摘要、进行内容问答,离线运行保障隐私和安全。它功能丰富且轻巧,支持多平台,GitHub已破1.8K star。
谷歌又赢了,nano banana「被迫」改名后,网友搞出7种神仙玩法
谷歌神秘图像编辑模型 nano banana 改名后仍热度高,与竞品相比生成速度快、成本低、能力强。已在 Gemini 应用和 Google AI Studio 上线,网友开发出制作等距模型、标注现实世界等7种玩法。
惠州老板搭上英伟达,公司市值半年飙涨1300亿
胜宏科技董事长陈涛白手起家,带领公司深度绑定英伟达等头部客户。2024年营收超107亿,市值半年涨1300亿。今年公司积极融资扩张,同时高管减持引投资者担忧。
41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码
智谱基于GLM - 4.5打造的开源多模态视觉推理模型GLM - 4.5V,在42个公开榜单中41项夺得SOTA。其功能丰富,玩法升级,还为企业与开发者提供高性价比方案,是100B参数级SOTA标杆。
哇塞!Chrome MCP + OpenAI Whisper = 播客秒变学习笔记
作者分享Chrome MCP + OpenAI Whisper将播客秒变学习笔记的工作流。此组合成本低、无限制、学习成本低,通过实例演示音频下载、转录及划重点等步骤,适用于多种场景,性价比高。