多风格图像」共找到 4511 篇相关文章

新闻资讯7

刚刚!软银系创始人4个月打造机器人超级黑马,获2轮近亿元融资

9月23日,成立仅四个月的具身智能机器人企业浩海星空,获浙江仙通4000万战略投资。其创始人齐建伟有二十年技术积累,浩海星空精准卡位,选教育等场景破局,还前瞻布局双足人形机器人。

新智元
算法论文8

华人团队终结Token危机:扩散模型数据潜力超自回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
算法论文8

X-Actor 惊艳登场!长时唇动+情感同步人像动画生成

字节提出 X - Actor,一个音频驱动自回归扩散框架,能通过一张静态参考图像和一段音频生成逼真、富有情感表达的人像动画视频。其核心是两阶段解耦生成流程,实现长时间唇形同步与情感音频一致性。

带你学AI
产品应用8

DeepRare 重磅发布:全球首个可循证智能体诊断系统,直击医学Last Exam难题

上海交通大学人工智能学院等联合发布全球首个罕见病推理型智能体诊断系统DeepRare。它结合大模型和智能体架构,模拟医生诊断思维,支持模态输入,在数据集评估中表现出色,已上线在线平台。

机器之心
开源动态8

RAG终极框架!港大开源RAG-Anything:统一模态知识图谱

香港大学黄超教授团队发布开源项目RAG - Anything,构建统一模态知识图谱架构,解决传统RAG技术局限。它能处理类型异构内容,提供端到端方案,有种优势及应用模式,还给出部署指南和未来展望。

新智元
新闻资讯8

继AlphaFold之后,DeepMind再放“大招”:AlphaGenome直击疾病根源

谷歌DeepMind推出AI模型AlphaGenome,可预测DNA序列微小变化对基因调控的影响,已向非商业研究领域开放。它能处理长序列、输出高分辨率结果,有四大优势,在领域有研究潜力,但也存在局限。

AI寒武纪
产品应用8

Midjourney正式推出 V1 视频模型:美学细节无敌

Midjourney推出视频生成模型V1,主打高性价比、易上手。采用“图像转视频”工作方式,有两种动画和运动幅度设置。入门价每月10美元,任务成本低,未来一月或调价格,目标是实现实时交互开放世界模拟系统。

AI寒武纪
产品应用8

离谱!现在的Agent都卷成100个成团了?3分钟并行干完5个复杂任务,还能随时改需求

百度文库、百度网盘联合发布全球首个全端通用Agent——GenFlow2.0,能让100+AI专家Agent天团并行工作,3分钟交付5、6个复杂任务,还能随时改需求。它依托权威资料,可控性强,任务并行,已上线百度文库Web端/APP。

量子位
算法论文8

稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow

本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在环境测试中表现优,有稳定、快速、样本效率高的特点。

机器之心
算法论文8

Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了

Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。

量子位