「RAW 图片编辑器」共找到 216 篇相关文章
本周 5 个超酷 GitHub 开源项目,实用到飞起!
本文介绍本周5个超酷GitHub开源项目。有显示苹果设备电池状态的AirBattery,开源卫星可视化平台keeptrack.space,本地图片压缩工具Pic - Smaller,跨平台端口助手Port - Killer,轻量级AI证件照工具HivisionIDPhotos。
看看人家的项目,一行命令即搞定,优雅、好看!
开源君发现神器 Freeze,它由 Charm 团队开发,能将代码文件或终端输出渲染成图片,支持多格式、高度定制,有交互界面,在 GitHub 获 4.4k Star,适合写博客、做分享的人。
我在OpenAI修中文
OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。
狂赚 21.6K star!超牛的Cursor免费平替项目,隐私友好、功能超强,真的香!
开源君分享了开源AI代码编辑器Void,它是基于VS Code魔改的「开源版Cursor」,保留VS Code优点,AI辅助编码出色。在Github获21.6K star,有隐私保护等特色,操作简单易上手。
GPT Image 2研究科学家陈博远:我在OpenAI修中文
GPT Image 2发布引发AI圈震动,主力训练者陈博远分享幕后故事。他和奥特曼同台主持,修好中文渲染,给模型起代号“布基胶带”,还设计多种“彩蛋级”测试,抖出官网图片幕后花絮。
视频扩散模型新突破!清华腾讯联合实现高保真3D生成,告别多视图依赖
清华大学联合腾讯提出Scene Splatter,基于视频扩散模型,从动量视角引导其生成满足三维一致性的视频片段,提升三维场景生成效果,解决了传统方法在单张图片重建三维场景的难题。
离谱!我以为 OCR 还在一页页抠字,结果百度 1.2 万 Star Unlimited-OCR 直接把长文档一口气读完
百度开源的Unlimited - OCR项目目标是处理图片、长文档等资料,将其转化为Markdown等结构化结果。它提供多入口,解决传统OCR处理长文档的问题,有多种应用方向,但也有边界。
AI玩拼图游戏暴涨视觉理解力,告别文本中心训练,无需标注的多模态大模型后训练范式
在多模态大模型后训练浪潮中,现有方法多以文本为中心。MMLab@南洋理工大学提出Visual Jigsaw,将拼图任务用于后训练,让模型不依赖标注强化视觉感知与理解,在图片、视频和3D模态验证有效。
一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建
中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。
AI短剧生成神器
作者分享开源的AI短剧生成工具,它能根据剧本完成智能分镜、生成视频片段等一条龙服务,采用全局种子+风格继承改善人物和场景一致性,有分镜编辑器可手动调控,适合多种人群。