多任务处理」共找到 5765 篇相关文章

开源动态7

MCP实战|从0到1构建异步 DeepResearch 工具,支持进度推送与超时控制

本文借助开源项目,构建可在MCP Server中异步运行的DeepResearch,支持任务进度推送与超时控制。介绍项目架构、构建步骤、任务管理器实现要点及效果测试,还提及优化方向并给出源码。

AI大模型应用实践
产品应用8

开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了

OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,能简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,高校团队已试用。

机器之心
开源动态8

腾讯重磅开源:端到端文档转换VLM,中英文错误率双料最佳!

腾讯开源端到端文档转换视觉模型POINTS - Reader,可将文档图片转结构化文本。它基于POINTS1.5架构,支持中英文。在OmniDocBench基准上,中英文错误率暂列最佳,具零后处理简单等亮点。

开源星探
产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型!

Qwen3-LiveTranslate-Flash 是基于大语言模型的语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有语言和方言支持、视觉增强等亮点,性能超主流大模型。

通义千问Qwen
新闻资讯7

Meta 超级智能团队全部 44 人详细名单泄漏!

Meta超级智能团队全部44人详细名单泄漏,中国成员占比高,成员有博士学位,来自OpenAI等,部分为L8+级别,不少是第一代移民,成员年薪或在1000万至1亿美元间。

AI工程化
算法论文7

BLIP3-o统一图像生成与理解,模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。

CourseAI
算法论文8

大模型被确诊「视觉文盲」!校联合提出MILO,为它植入空间想象力

空间推理是模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。

量子位
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
产品应用8

NVIDIA 推出Rubin CPX,专为AI推理设计的GPU

NVIDIA发布专为大规模上下文AI推理设计的Rubin CPX GPU,性能提升显著,集成视频编解码器和长文本推理处理。新平台算力强,适用于代码生成与视频处理家公司将采用,2026年底上市。

AI工程化
开源动态8

耶鲁等团队联合发布首个虚拟细胞Agent,可自动设计出先进的模型

耶鲁等团队发布首个智能体系统CellForge,可自动化设计虚拟细胞模型。它能输出模型架构和代码,有跨模态能力,性能超个领域代表性模型,可降低科研门槛,加速药物研发。

力学与人工智能