多风格图像」共找到 4502 篇相关文章

产品应用8

AgentScope x RocketMQ:打造企业级高可靠 A2A 智能体通信基座

文章介绍 Apache RocketMQ 新推的 LiteTopic 通信模型,能简化 AI 系统架构、提升稳定性。结合 A2A 协议与 AgentScope 框架案例,剖析智能体通信实践与技术实现,还给出构建智能体应用的实战方案。

阿里云开发者
产品应用8

谷歌Nano Banana全网刷屏,起底背后团队

谷歌开发者节目展示了Gemini 2.5 Flash Image模型,它能快速生成高质量图像、保持场景一致。文中起底背后团队成员,还介绍模型技术亮点、与Imagen对比及未来能力展望。

机器之心
算法论文8

转载 | 赖姜研究员等:基于人工智能的结构力学专题序

基于人工智能的结构力学研究因领域融合取得进展,突破传统瓶颈。《力学学报》组织专题含6篇论文,展示我国科研人员在该领域结合的最新成果,位专家参与,介绍了专题相关研究及期刊信息。

力学与人工智能
开源动态8

惊艳!GitHub 开发者一键接入!4.2k star 项目 Champ,用一张照片秒变动画

Champ项目致力于从一张静态人物图生成人体动画,将3D参数化人体模型引入扩散模型。它解决了传统动画效果不真实等痛点,有诸核心功能,技术优势明显,在领域有高应用价值。

小华同学ai
开源动态8

新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!

Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持语言,有种使用方式,适用于个场景,架构采用模块化设计。

开源星探
开源动态7

二创党福音!基于AI的开源智能视频切片处理系统

AutoClip是基于AI的开源智能视频切片处理系统,能自动从平台下载视频、提取精彩片段并生成合集。适合UP主、内容创作者等,有平台支持、AI智能分析等特性,部署方式简单。

GitHubStore
开源动态8

开源AI引爆热潮!GOSIM AI Paris 2025首日直击:80+位技术大咖聊模型、拼算力、秀落地

5月6日,GOSIM AI Paris 2025大会在法国巴黎启幕,80余位技术专家与学者参会。GOSIM联合创始人认为开源AI已追上闭源,AGI或由模型组成网络。大会设四大分论坛解析开源AI,还有特色单元,明日将迎PyTorch Day。

AI科技大本营
开源动态7

年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川

年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等个模型,各有亮点,如Qwen3 - TTS覆盖语种,LongCat支持重思考模式。

PaperAgent
算法论文8

CMAME|美国西北大学,德州大学|Wing Kam Liu及 TJR Hughes 等: LLM赋能的下一代计算机辅助工程

工程仿真里有限元方法常见,但计算与人力成本高。此研究提出把大语言模型变为计算机辅助工程智能体,开发不依赖训练数据的降阶求解器,在问题上表现佳,为下一代计算机辅助工程提供框架。

力学与人工智能
开源动态7

Ultralytics & lightly-train:简化计算机视觉模型训练,无需标签

在计算机视觉领域,获取带标签数据成本高、耗时长。开源项目 lightly-train 用未标记图像和视频自监督预训练,减少标注成本与时间,可集成到现有训练管道,支持种模型架构和应用场景。

机器学习AI算法工程