多任务并行」共找到 5374 篇相关文章

产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型!

Qwen3-LiveTranslate-Flash 是基于大语言模型的语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有语言和方言支持、视觉增强等亮点,性能超主流大模型。

通义千问Qwen
新闻资讯7

Meta 超级智能团队全部 44 人详细名单泄漏!

Meta超级智能团队全部44人详细名单泄漏,中国成员占比高,成员有博士学位,来自OpenAI等,部分为L8+级别,不少是第一代移民,成员年薪或在1000万至1亿美元间。

AI工程化
算法论文7

BLIP3-o统一图像生成与理解,模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。

CourseAI
算法论文8

大模型被确诊「视觉文盲」!校联合提出MILO,为它植入空间想象力

空间推理是模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。

量子位
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
开源动态8

耶鲁等团队联合发布首个虚拟细胞Agent,可自动设计出先进的模型

耶鲁等团队发布首个智能体系统CellForge,可自动化设计虚拟细胞模型。它能输出模型架构和代码,有跨模态能力,性能超个领域代表性模型,可降低科研门槛,加速药物研发。

力学与人工智能
产品应用8

1分钟跑出数百预测!WeatherNext 2把短时预报带入小时级

谷歌DeepMind发布WeatherNext 2,能1分钟从同一初始场生成上百种未来,分辨率达1小时级,超上一代。它已接入Search等,重写天气预报逻辑,让预测从确定变可能,还将改变气象体系。

新智元
算法论文8

LabVLA:当AI走进科学实验室,浙大x上海 AI Lab联合探索科学具身智能

浙江大学与上海人工智能实验室联合推出 LabVLA,探索更具泛化能力的科学具身智能范式。团队构建仿真数据引擎 RoboGenesis 与语料 LabEmbodied - Data,LabVLA 在测试中表现良好,还将探索场景应用。

机器之心
产品应用8

百文心快码正式发布AI IDE,首创设计稿一键转代码、支持MCP

6月23日,百度副总裁陈洋发布文心快码独立AI原生开发环境工具Comate AI IDE,是行业首个模态、智能体协同的AI IDE,首创设计稿一键转代码,亮点、功能强,适配开发场景。

AI前线
开源动态8

想让机器人春晚包饺子?阿里达摩院:别急,先把「大脑」优化一下

阿里达摩院推出 RynnBrain 模型,从底层出发将时空记忆和物理空间推理训进模型,在 16 项具身 Benchmark 上达 SOTA。还开源 7 个模型,解决通用大模型在物理世界的局限,在任务表现出色。

机器之心