画面化」共找到 840 篇相关文章

推荐文章7

一文讲透程序编排的核心方式:从表达式语言到并行实践

文章围绕程序编排展开,介绍单语句编排、类编排、流程编排、并行编排等核心方式,分析多种编排框架特点及适用场景,还提及Lindorm泛时序数据解决方案,为开发者提供编排参考。

阿里云开发者
开源动态8

阿里重磅开源:端到端VLM文档解析模型,图片直出结构HTML!

在AI文字识别类应用中,文档解析常不尽人意。阿里开源端到端文档解析模型Logics - Parsing,基于VLM,能图片直出结构HTML,有统一、智能、精细等亮点,还给出使用步骤。

开源星探
产品应用7

隐私优先的本地匿名小模型:在数据离开设备前保护个人信息

最强 AI 模型在云端,安全数据在本地,这一矛盾困扰着想用 AI 处理敏感信息的人。Freysa 团队提出解法,不重写提示,只替换敏感信息,用小模型实现精准匿名,有实用价值。

AI工程化
新闻资讯7

蚂蚁阿福:从 0 到生产的医疗 Agent 工程落地|QCon 北京

4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程落地》,探讨技术体系与布局,还有20多个专题论坛。

InfoQ
新闻资讯7

蚂蚁阿福:从 0 到生产的医疗 Agent 工程落地|QCon 北京

4月16 - 18日QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题,有百余落地案例。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程落地》,探讨构建技术体系等内容。

InfoQ
新闻资讯7

Telegram创始人搞了个狠活:100%隐私的去中心AI网络

Telegram创始人帕维尔·杜罗夫推出专注机密AI计算的去中心网络Cocoon,或终结中间商垄断。它基于TON区块链,有三层架构,四步完成AI查询,但面临延迟和竞争挑战,未来将采用DAO治理。

AI工程化
开源动态7

无需 OCR 就能从各类文档中提取结构信息的本地开源工具docext

docext是无需OCR的本地开源工具,能从发票、护照等文档图像提取结构信息。智能文档处理排行榜评估VLMs在多任务表现,docext有灵活提取、表格提取等功能。

GitHubStore
新闻资讯7

Nano Banana 2突然现身!能画公式解数学题,监控画面都能伪造

Nano Banana 2代以预览版现身第三方网站,后被移除。其能力远超1代,能处理复杂提示,可生成复杂UI、解数学题甚至伪造监控画面。谷歌正将Nano Banana整合进核心产品生态。

量子位
产品应用8

Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构数据

Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词元消耗大幅降低。

InfoQ
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”具像

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化