多尺度生成」共找到 5656 篇相关文章

开源动态7

下一代架构设计工具,说话就能画

next-ai-draw-io是开源项目,用自然语言描述就能让AI自动生成draw.io格式的图。有文字生成图表等核心功能,技术栈用Next.js + AI SDK + react-drawio,支持提供商,还介绍了安装、部署方法。

GitHubStore
开源动态7

3.3k星星!用AI做前端动效最好的开源项目,给AI写前端代码注入灵魂

现在AI编程做的前端效果不佳,页面不生动、特效生硬。而Text-to-Lottie开源框架可通过AI编程Agent快速生成生产级Lottie动画,支持种输入,有实时预览与编辑功能,还能集成平台,简化动效开发。

开源AI项目落地
新闻资讯7

The Batch: 938 | Gemini 的音乐生成

Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持语言歌词。在质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。

DeeplearningAI
开源动态8

BigBang-Proton: 自回归基座模型统一语言、科学和物质世界

超对称公司发布新版基座模型 BigBang - Proton,实现学科问题与 LLM 统一预训练和推理,挑战主流 AGI 技术路线。它有三项创新,在专业学科任务表现出色,还提出宇宙尺度压缩构想。

InfoQ
新闻资讯7

The Batch: 900 | “去衣化”图像引发监管警觉

xAI的Grok聊天机器人未经同意生成数万张对女孩和女性性化处理图像,引发国政府警觉。各国采取调查、出台监管措施、封锁访问等行动,X也作出回应,限制图像生成。此前国已出台相关法律。

DeeplearningAI
开源动态8

Agentic Coding表现创新高,全新KAT系列模型强势霸榜SWE-Bench

快手 Kwaipilot 团队推出 KAT 系列两款 Agentic Coding 大模型,KAT - Dev - 32B 开源,KAT - Coder 闭源。两模型在 SWE - Bench Verified 表现出色,且在训练阶段创新优化,有强大代码生成能力和涌现现象。

机器之心
产品应用8

比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一

昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持语言短剧生成、视频编辑等,将在中关村论坛亮相。

机器之心
开源动态8

自回归科学基座模型 BigBang-Proton,提出实现 AGI 的新路线

超对称公司发布自回归科学基座模型 BigBang - Proton,挑战主流 AGI 技术路线。它实现学科问题与 LLM 统一预训练和推理,有三项创新,在专业任务表现出色,还提出宇宙尺度压缩构想。

AI科技大本营
开源动态8

Qwen新开源,把AI生图里的文字SOTA拉爆了

通义模型家族新开源图像生成模型Qwen - Image,是通义千问系列首个图像生成基础模型。实测其对提示词理解到位,文字渲染高保真。它具备复杂文本渲染、一致性图像编辑能力,在基准测试达SOTA。

量子位
开源动态8

1.9K Star 微软开源TTS王炸!90分钟超长语音合成,4人对话自然切换!

在文本转语音(TTS)领域,生成长篇、说话人的高质量音频一直是技术挑战。微软最新开源的VibeVoice TTS模型,可一次生成90分钟连续语音,支持4个不同说话人,还具备高效处理长序列等亮点特性。

开源星探