图像自动着色模型」共找到 1015 篇相关文章

产品应用7

FlowUs 创始人创立 Kollab,要为 AI 构建团队大脑

AI 从对话框向 Agent 等形态演变,完成单个任务能力增强,但工作场景中仍有协作断裂问题。Kollab 产品想解决此问题,让任务在组织自动流动,切中 Team - level AI,有共享工作空间等 4 个层级。

投资实习所
新闻资讯8

Anthropic冲塔ASI自进化,要做全球操作系统!Claude OS一刀砍向6.4万亿帝国

Anthropic野心勃勃,开启ASI自进化,目标打造全宇宙最强AI操作系统Claude OS,欲抢夺苹果微软6.4万亿市值。Claude可控制电脑,多项功能上新,还推出自动模式,且营收增长快、客户结构优化,离ASI越来越近。

新智元
产品应用8

Google Gemini Embedding2:一个模型处理所有媒体类型

Google发布Gemini Embedding 2,首个原生多模态嵌入模型。能处理文本、图像等多种媒体类型,支持交错输入,覆盖超100种语言。与多模型串联方案比,延迟降70%、召回率升20%。已可在Gemini API等使用。

AI工程化
开源动态8

GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!

GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器可自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。

开源星探
新闻资讯8

Andrej Karpathy:做个好人,未来的 LLM 正在看着你

Andrej Karpathy 12 月 10 号写 blog,用现在视角为十年前 Hacker News 帖子自动打分,开源代码。他近期多篇文章探讨 LLM 相关,如可验证性、智能空间对比等,还启动 Eureka Labs。他认为未来 LLM 会审视当下行为。

MacTalk
算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
开源动态7

下一代架构设计工具,说话就能画

next-ai-draw-io是开源项目,用自然语言描述就能让AI自动生成draw.io格式的图。有文字生成图表等核心功能,技术栈用Next.js + AI SDK + react-drawio,支持多提供商,还介绍了安装、部署方法。

GitHubStore
推荐文章8

视觉生成的另一条路:Infinity 自回归架构的原理与实践

本文整理自字节跳动韩剑在AICon 2025北京站的分享,以Infinity为例介绍自回归视觉生成原理,对比其与扩散模型,展示Infinity升级方案成果,它在高分辨率文本到图像任务能与扩散模型竞争。

InfoQ
新闻资讯7

马斯克xAI自研推理芯片曝光!代号X1、台积电3纳米工艺、明年就量产

马斯克的xAI被曝自研推理芯片X1,用台积电3纳米工艺,2026年三季度量产。此前xAI就为自研芯片招兵买马,还将在西雅图设办事处。此外,特斯拉也在推进自研推理芯片。

量子位
新闻资讯7

The Batch: 870 | 手机上的主动式AI助手

谷歌发布Pixel 10,搭载Magic Cue AI系统。它基于新版Gemini Nano,运行在Tensor G5处理器上,能预判用户需求,自动提供相关信息。谷歌早就在手机推AI,此次将其深度融入系统和应用。

DeeplearningAI