「可观测性数据」共找到 5975 篇相关文章
9.9K star 惊艳,一行代码即可生成!
介绍了基于Python的开源工具MapToPoster,它能通过一行代码将全球任意城市地图转化为极简艺术海报。项目在Github有9.9k+ star,有多种功能特性,操作简单,降低了地图设计门槛。
Vercel 开源 json-render!短短 4 天狂揽 7500 Star,这才是 AI 生成 UI 的终极解法!
Vercel 开源的 json - render 4 天获 7500 Star,解决生成式 UI 不可控问题。采用‘AI → JSON → UI’公式,结合‘约束’与‘流式’机制,还有反向生成源码功能,介绍了快速入手办法与适用场景。
“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约
当前多模态大模型推理效率低、稳定性不足。本次分享将介绍DMLR,它无需额外训练,仅在推理阶段生效,通过在潜空间优化潜在思考token、引入关键视觉信息,实现高效稳定的多模态推理。
压缩之外,Visual Tokenizer 也要理解世界?
MiniMax和华中科技大学发布视觉tokenizer新研究VTP,引发业界热议。该研究揭示传统仅以重建为目标的视觉tokenizer缺乏高层语义表示,提出在预训练中引入语义理解,还发现Scaling Law现象,虽有争议但为研究提供新视角。
Gemini AI /Nano Banana Pro图像无损去水印工具
这是基于Javascript的纯浏览器端Gemini AI图像无损去水印工具,用反向Alpha混合算法,有纯浏览器端处理、隐私保护等特性,介绍使用方法、算法原理等。
医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26
南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。
阿里又上好货了!Qwen3-TTS能力大幅提升
阿里刚发布Qwen3-TTS(2025-11-27版),解决语音合成核心问题。它音色大幅扩展,有49种高品质音色;语言和方言能力提升,支持10种主流语言与多种方言;韵律和语速优化,拟人化近真人;API调用简单。
刚刚,ICCV最佳论文出炉,朱俊彦团队用砖块积木摘得桂冠
10月22日凌晨,ICCV揭幕本年度奖项。卡耐基梅隆大学朱俊彦团队《Generating Physically Stable and Buildable Brick Structures from Text》获最佳论文奖,提出BrickGPT;以色列理工学院《FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models》获最佳学生论文奖。
阿里重磅开源:端到端VLM文档解析模型,图片直出结构化HTML!
在AI文字识别类应用中,文档解析常不尽人意。阿里开源端到端文档解析模型Logics - Parsing,基于VLM,能图片直出结构化HTML,有统一、智能、精细等亮点,还给出使用步骤。
《2025新智元ASI前沿趋势报告》全文
新智元十周年峰会现场,重磅发布《2025新智元ASI前沿趋势报告》,预测2027抵达ASI临界,智能体全面爆发,图谱融合全球数据刻画全球竞争格局。