多粒度编辑」共找到 4261 篇相关文章

产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型!

Qwen3-LiveTranslate-Flash 是基于大语言模型的语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有语言和方言支持、视觉增强等亮点,性能超主流大模型。

通义千问Qwen
新闻资讯7

Meta 超级智能团队全部 44 人详细名单泄漏!

Meta超级智能团队全部44人详细名单泄漏,中国成员占比高,成员有博士学位,来自OpenAI等,部分为L8+级别,不少是第一代移民,成员年薪或在1000万至1亿美元间。

AI工程化
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
开源动态8

出自小米的模块化图像编辑改造:让 AI 学会「搭积木」

小米研究团队发布 Lego-Edit 图片编辑框架,将复杂编辑任务拆成工具集和调度系统,工具集模型各司其职,调度系统指挥操作。采用渐进式训练,性能优、扩展性好,体现协同智能优势。

AGI Hunt
开源动态8

耶鲁等团队联合发布首个虚拟细胞Agent,可自动设计出先进的模型

耶鲁等团队发布首个智能体系统CellForge,可自动化设计虚拟细胞模型。它能输出模型架构和代码,有跨模态能力,性能超个领域代表性模型,可降低科研门槛,加速药物研发。

力学与人工智能
产品应用8

1分钟跑出数百预测!WeatherNext 2把短时预报带入小时级

谷歌DeepMind发布WeatherNext 2,能1分钟从同一初始场生成上百种未来,分辨率达1小时级,超上一代。它已接入Search等,重写天气预报逻辑,让预测从确定变可能,还将改变气象体系。

新智元
算法论文8

LabVLA:当AI走进科学实验室,浙大x上海 AI Lab联合探索科学具身智能

浙江大学与上海人工智能实验室联合推出 LabVLA,探索更具泛化能力的科学具身智能范式。团队构建仿真数据引擎 RoboGenesis 与语料 LabEmbodied - Data,LabVLA 在测试中表现良好,还将探索场景应用。

机器之心
产品应用8

超越Runway!Adobe发布新神器:P视频比P图还简单

Adobe联合高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。

新智元
产品应用8

百文心快码正式发布AI IDE,首创设计稿一键转代码、支持MCP

6月23日,百度副总裁陈洋发布文心快码独立AI原生开发环境工具Comate AI IDE,是行业首个模态、智能体协同的AI IDE,首创设计稿一键转代码,亮点、功能强,适配开发场景。

AI前线
产品应用7

告别先开发后治理:Agent 驱动的数据质量一体化交付

文章指出离线数据开发中数据质量建设面临开发与治理分离的困境,如治理滞后、迭代不同步等。DataWorks引入Data Contracts理念,以YAML Spec形式将质量规则嵌入开发流程,还可借助Agent配置规则,未来将引擎覆盖、降低门槛并融入IDE。

阿里云开发者