多任务并行」共找到 5379 篇相关文章

开源动态7

刚刚微软开源视频录制技能skill-recorder

微软开源视频录制技能 Skill Recorder,能将用户完成任务的过程转化为 AI 智能体可重复执行的技能。它捕获屏幕工作会话,用 GitHub Copilot CLI 重构操作,生成可复用内容,支持平台。

GitHubStore
产品应用7

Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作

Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。

量子位
开源动态8

开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具

FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等项能力,适用于场景,介绍了安装方式、优缺点。

小华同学ai
算法论文8

打破视觉Token的算力诅咒,RedundancyLens如何为模态大模型推理减负

模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于场景。

PaperAgent
算法论文8

拖拽视频编辑进入流式时代!任意时刻、任意内容,实时修改 | ICLR'26

新加坡南洋理工大学和合肥工业大学研究人员在ICLR 2026提出REVEL任务,打造免训练DragStream方法,实现视频生成时实时拖拽编辑,支持种操作,破解两大难题,实验显示效果、泛化性佳。

新智元
产品应用7

Claude Opus 4.7发布:更强能力,自我纠错,越来越不需要人类干预了

Anthropic发布Claude Opus 4.7版本,搭配Routines功能可自动化工作,人类干预减少。该版本能力大幅增强,还引入护栏机制保障安全,推出新运算级别和任务预算功能。

AIGC开放社区
算法论文8

VLA别再「走神」:即插即用提升视觉泛化,相对Pi0.5提升18%

至简动力、北大、港中文团队发现VLA模型深层动作预测对关键视觉区域依赖下降,提出DeepVision - VLA框架,在仿真和真实任务中效果显著,能有效提升视觉泛化能力。

量子位
算法论文7

架构解耦是统一模态模型所必须的吗?全新AIA损失:No

香港中文大学 MMLab 和美团研究者思考架构解耦是否为统一模态模型必须,推出 AIA 损失。研究发现架构解耦未解决任务冲突,AIA 能提升模型性能,减少数据配比问题。

机器之心
推荐文章8

想实现AGI,得先建好“AI工厂”

人工智能算力需求膨胀,行业陷入‘暴力美学’迷思。摩尔线程在2025 WAIC前夕提出‘AI工厂’理念,解构其‘五要素’,并展示领域应用案例,为算力建设提供系统性解法。

InfoQ
产品应用8

GitNexus:GitHub一周暴涨6000星!这个"零服务器代码神器"让AI终于能看懂你的代码了

GitNexus是零服务器代码智能引擎,能将GitHub仓库或ZIP文件转为交互式知识图谱,让AI看懂代码依赖。它有知识图谱构建等功能,支持语言,适用于接手项目、代码审查等场景。

小华同学ai