「开源应用」共找到 4800 篇相关文章

开源动态7

狂涨 2W+ star,安卓终于“满血”用上!

AirPods在非苹果设备上功能受限,而开源项目LibrePods打破这一限制。它由16岁印度少年开发,逆向解析协议,让非苹果设备伪装成苹果设备与耳机通信,解锁多项高级功能,已支持安卓和Linux。

开源先锋
开源动态8

DeepSeek倒逼vLLM升级!芯片内卷、MoE横扫千模,vLLM核心维护者独家回应:如何凭PyTorch坐稳推理“铁王座”

本文介绍了vLLM的发展,自开源后成科技公司首选推理引擎。因DeepSeek发布,团队转向其模型特性优化;还参与各芯片支持工作。vLLM靠PyTorch支持多硬件,同时拓展到多模态推理,面临竞争仍保持优势。

InfoQ
推荐文章8

大模型开发实战从入门到入坑:动手写一个MCP Server去理解MCP背后的技术原理

文章聚焦MCP协议,介绍其是规范应用向大模型提供上下文的开放协议,能让模型调用接口更简单、实现开发解耦。还深度解析技术原理,手把手教从0到1实现MCP Server,助读者理解背后技术。

阿里云开发者
算法论文8

大模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力

空间推理是多模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。

量子位
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区
开源动态8

1B参数,0.21秒识别,0.3%错字率:混元OCR拿下7项SOTA

腾讯开源模型 HunyuanOCR 在权威榜单 OmniDocBench 上霸榜,虽仅 1B 参数,却在 7 项任务击败众多大模型。它解决传统 OCR 流水线及通用大模型痛点,通过独特架构和训练方法实现高效准确识别。

CourseAI
新闻资讯7

工作场景AI化,一个月花100美元订阅AI工具值吗?

AICon 全球人工智能开发与应用大会 2025 北京站即将召开,InfoQ 直播栏目邀请来也科技胡一川、阿里汤威、美团邹明远、快手王东旭探讨 AI 时代「10x 个体」与「10x 组织」,分享落地路径、效率提升及工具使用经验。

AI前线
产品应用8

用AI“打开”金融市场黑盒:微软亚洲研究院如何构建订单级仿真引擎

在大模型与智能 Agent 崛起的时代,金融行业变革不断。微软亚洲研究院刘炜清在 AICon 大会分享,团队构建金融基座模型与 Agent 流程,实现高保真市场模拟与决策优化,还介绍了相关平台和模型构建应用。

InfoQ
产品应用8

产品经理起飞!Google AntiGravity升级Nano Banana Pro,AI编程真的牛逼了

作者用Google新发布的AntiGravity生成海报,其升级增加Nano Banana Pro能力后效果惊人。作者展示了用它生成高保真原型图、用户故事地图、用户旅程地图等案例,还提及更多应用场景及使用建议和限制。

AI产品黄叔
开源动态8

一个能思考、会记忆的AI导演诞生了!新加坡管理大学,香港中文大学等实现故事化视频生成

新加坡管理大学等提出开源全能多智能体框架UniVA,可统一视频理解、分割等能力,按指令生成完整故事视频。还引入UniVA - Bench基准测试套件,实验显示其在多任务中表现出色,代表视频智能生成重要进步。

AIGC开放社区