「架构图生成」共找到 3959 篇相关文章
Midjourney新副业曝光:50万个传感器藏进浴池,60秒生成你的3D身体地图
搞AI绘画的Midjourney官宣将在旧金山开Spa馆,背后是进军医疗硬件的新项目Midjourney Medical。其用Midjourney Scanner做全身超声波扫描,能快速生成高精度3D身体地图,还规划了落地路径和长期扩张目标。
自回归模型杀回图像生成!实现像素级精准控制,比Diffusion更高效可控
当下AI图像生成领域,Diffusion模型虽为主流,但在精准控制上有不足。伊利诺伊大学香槟分校等机构研究者提出MENTOR框架,用自回归模型实现像素级精准控制,比Diffusion更高效可控。
别让Nano Banana骗了!混合方案让头像生成成功率从0到100%
作者用Nano banana更新头像时发现其生成中文能力差,提出将AI画图与HTML编程结合的方案。HTML搞定确定性、成本低部分,AI画图负责复杂、创意性高部分,还给出使用方法及多种头像加字设计方案。
拥有Github 的微软终于出手,发布一键生成全栈应用的GitHub Spark!
微软发布GitHub Spark,能以自然语言生成全栈应用并一键部署,默认用Claude Sonnet 4。它遵循微应用理念,有强大功能体系,深度集成GitHub。开发者看法不一,目前向Copilot Pro+用户开放,或改变市场格局。
谷歌“世界模拟器”深夜上线!一句话生成3D世界,支持分钟级超长记忆
谷歌DeepMind发布新一代通用世界模型Genie 3,只需一句话就能生成可实时交互的3D世界。性能大幅升级,支持720P画质等,还能推动具身智能体研究,谷歌期待其助力迈向AGI。
独家|美图入局 Visual Agent,Chance AI 完成数百万美元天使轮融资
美图布局下一代视觉 AI 入口,领投 Visual Agent 创业公司 Chance AI 数百万美元天使轮融资。该公司成立于 2025 年 8 月,从北美大学生切入,有独特产品逻辑,融资后将推进多方向发展。
Medeo 教程:一次生成无脑抽卡不可取,真正的视频 Agent 应该啥样
本文介绍AI视频生成Agent Medeo 1.0版本,它支持短或超长提示词,泛化性好,多种垂类视频都能做。文中介绍其基础操作、展示案例和提示词,还剖析了能兼顾质量与灵活度的原因,目前产品在内测将全量上线。
真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文
MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。
字节版龙虾架构火爆GitHub!开源获35k+ Star,内置Skill全家桶,原生适配飞书
字节开源Deer - Flow2超级智能体管理框架,登上GitHub Trending榜首,获35.3k Star。它采用模块化多智能体架构,主打开箱即用,扩展性强,适配多种IM渠道,还介绍了核心能力、部署方式等。
AI 出图为什么总很土?2100 星开源 Skill 用 244 行给了答案
AI出图常显土气,开源项目`gc - minimal - zine - poster`用244行文档给出答案。它将日系zine感拆分为可执行指令,规定九个渲染问题,还给出取值区间和自检方法,能防止风格自我复制,且适配多种Agent。