流处理架构」共找到 2796 篇相关文章

开源动态8

源神阿里!图像生成Ovis-Image再开源,7B小参数媲美GPT-4o和20B开源模型

阿里Ovis团队发布Ovis - Image,7B参数文本到图像模型,在文本渲染任务媲美GPT - 4o和20B + 开源模型。它架构优化、数据工程精细、训练范式独特,实测数据表现佳,显存占用低、推理快。

AIGC开放社区
算法论文7

人大-清华-腾讯发布:音频 - 视觉多模态任务统一框架

人大、清华和腾讯合作发布Crab论文,目标是实现多模态场景理解任务的高效一统。它针对音频 - 视觉理解模型难点提出解决方案,构建数据集、设计LoRA结构、统一架构,训练分预训练和指令调整两阶段。

CourseAI
产品应用7

Deep Search 如何理解业务仓库代码?

文章系统介绍Deep Search和Deep Research概念、与传统RAG区别、主商业产品与开源方案、在代码领域应用及未来规划。提出Deep Search方案,构建独特代码理解与检索架构,还计划研发专用代码搜索Agent。

阿里云开发者
开源动态8

自定义轨迹驱动AI视频生成,ATI无需训练适配多种生成模型

字节提出视频生成运动控制统一框架ATI,通过轻量级运动注入器将用户定义轨迹投影至预训练图像 - 视频生成模型潜在空间,实现协调控制。用户指定关键点及路径控制运动,无需重新训练,适配不同架构

带你学AI
开源动态7

Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

Vibe Coding虽降低开发门槛,但Coding Agent处理复杂任务易失控。当前Agent缺乏工程状态层隔离控制,Valkor等联合开源loom,它将交付拆解成状态链,过滤噪音,为大模型落地提供状态基建。

机器之心
产品应用7

这帮清华的,造了一个让龙虾“安全着陆”的新物种

在OpenClaw热潮中,隐私保护缺位成企业和开发者难题。无问芯穹推出InfiniClaw Box,独创‘三段式’架构,适配全模态信源,解决数据安全与模型能力兼顾问题,还与多家企业合作拓展应用边界。

量子位
产品应用7

豆包大模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包大模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。

AI产品自由
开源动态8

OnlyOffice 平替,用 Vue3 + Vite 做了个“本地 OnlyOffice”:接入成本低到离谱!!!

文章介绍 onlyoffice-web-local 项目,它是基于 OnlyOffice 的纯前端本地网页文档编辑器,无需服务器端处理,部署轻、接入快、更安全。阐述其功能、适用场景,给出开发部署及集成方案,可作 OnlyOffice 平替。

小华同学ai
开源动态8

MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一

MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。

AI工程化
开源动态8

Meta开源史上最强语音“基座模型”:一口气支持1600+种语言

Meta AI FAIR团队发布Omnilingual ASR模型套件,能为超1600种语言提供自动语音识别能力。它引入新架构提升性能,改变引入新语言范式,还发布相关数据集和模型,与全球伙伴合作。

AI寒武纪