「扩散生成模型」共找到 8730 篇相关文章
一个重要的发布被忽略!Decart发布实时“Sora”,直播/游戏业迎来新变革
Decart推出全球首个实时、无限长度的AI视频模型MirageLSD,基于独创的“实时流扩散”技术。其响应时间低于40毫秒,攻克了“错误累积”和实现实时响应两大难题,还计划拓展应用及升级功能。
用Cursor做UI,最有效的两个方法
作者黄益贺分享用Cursor做UI的两个方法,免费法是用Gemini等生成JSON配置贴到Cursor;付费法是API调用Vercel的v0模型。还提及添加动画提升体验及前端UI开发工具箱。
Claude: 可视化
文章指出早期人与人靠体力拉开差距,工业革命后比拼脑力,AI 时代脑力被大模型拿走,人将比较心力。面对 AI 生成的海量文本,可视化或为解决脑力理解带宽瓶颈的解药,还给出了相关 Prompt。
清华辍学、斯坦福睡地板,华人小哥用AI社交挑战Meta,融资数千万美元
来自中国的小哥Brandon Chen打造AI原生即时通讯工具Intent,已获数千万美元融资。它结合微信聊天与大模型自动执行功能,如处理图片、规划旅行、生成购物清单等,带来全新聊天体验。
Qwen-lmage-Layered:图片分层 指哪改哪
全新图像生成模型Qwen-lmage-Layered采用自研架构,将图片“拆解”成多个图层,各图层可独立操作。其提出新编辑思路,有RGBA - VAE等亮点,支持灵活迭代分解,能实现精准高效的图像编辑。
图像编辑新神器:英伟达用拍电影思维解决图像编辑与世界模拟一致性难题
AI图像编辑物理一致性难题待解,现有方法易产生违反物理定律的漂移编辑。英伟达和多伦多大学提出ChronoEdit框架,将图像编辑视为拍微型电影,借助视频生成模型的时间连续性知识解决问题,在实验中表现卓越。
刚刚,清华团队养出了一只「龙虾老师」!教育版OpenClaw震撼开源
清华教育学院与计算机系联合团队开源多智能体AI课堂OpenMAIC。它能一键生成交互式课程,AI老师语音授课、AI同学互动。经两年真实课堂验证,支持主流大模型,有望成教育版ClawHub。
故事式
作者李继刚在好友丁锐启发下尝试「故事式」Prompt,即塑造含「欲望」与「阻力」的动力场让模型生成回复,还给出如「字典疯子」「探索者」等多个故事式Prompt示例供读者体验。
AI助手Cici悄然霸榜海外,又是字节
AI智能助手领域有新玩家,字节跳动的Cici在多个国家应用商店霸榜,数月内下载量爆发式增长。它融合字节旗下技术,文本生成用到OpenAI、谷歌模型。同时,豆包在国内AI智能助手赛道全维度领先。
锁定角色,「多主体」也可控!个性化文生图,给你PS般交互体验
LayerComposer革新个性化图像生成,能让用户如在Photoshop般操控元素位置、大小,解决传统方法交互性与多主体扩展难题。它有分层画布、锁定机制、模型–数据共设计三大特点,实验表现出色,未来将促进人机协同创作。