「信息质量」共找到 1261 篇相关文章
一周1.2k星!兼具质量与效率的OCR模型MonkeyOCR,支持多样化的中英文PDF
MonkeyOCR采用SRR三元组范式,简化多工具流程、避免整页文档处理低效问题。与MinerU、端到端模型相比性能更优,处理速度也更快。暂不支持拍摄文档解析,文章还给出安装、推理等操作步骤。
卧底房产AI三天后,我发现地产圈的「信息差」,正被这样一铲到底!
文章测评房产AI工具CRIC深度智联,让其与OpenAI、Google、Anthropic旗下通用AI比拼写地产研报。结果显示,CRIC以独家行业数据库实现降维打击。此外,它还有普通和专业两版,适用不同人群,也指出AI有边界。
Jina Code Embeddings: 为高质量代码搜索而生的0.5B/1.5B向量模型
本文介绍了 Jina AI 开源的代码向量模型 `jina-code-embeddings`,含 0.5B 和 1.5B 规模,有 GGUF 量化版本。它性能顶尖,支持多任务与 15 种语言,还介绍了训练方案、使用方法等。
AI驱动的实时全球情报情报系统,绝大多信息免费!覆盖全球实时情报的多个维度!
实时全球情报仪表盘是AI驱动的态势感知界面,集成新闻聚合、地缘政治监测与基础设施追踪。数据源多为免费公开API,低延迟更新。有多种功能,技术栈丰富,聚合多领域65+外部数据源。
极客部落“OPC 创业者招募计划”正式启动 —— 携手朝阳区赋能 AI 时代独角兽,助推人才高质量发展
北京市朝阳区多部门与极客邦共同发起“极客部落·AI 应用生态园”及“OPC 创业者招募计划”,为创业者提供全方位加速支持。“朝阳青创十五条”涵盖多维度政策,3 月 20 日还有创业开放日活动。
给几何图片写标题就能让AI更聪明,UIUC发布高质量可泛化几何数据集
随着多模态大语言模型在视觉问答等任务广泛应用,其几何推理能力成研究热点。现有方法泛化能力有限,UIUC团队提出Geo - Image - Textualization框架,发布GeoReasoning - 10K数据集,提升模型几何推理表现。
攻克大模型「表格盲区」!ST-Raptor框架发布,实现复杂半结构化表格的精准理解与信息抽取
半结构化表格布局多样、结构复杂,让自动化数据处理困难。上海交大等团队发布 ST - Raptor 框架,提出 HO - Tree 数据结构及树上操作,构建 SSTQA 数据集,提升表格问答准确率,弥补大模型处理短板。
让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画
3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式。
宇宙尺度压缩:Scaling Law的边界,柏拉图表征收敛于物质和信息交汇,解决P与NP问题,Simulation假说……
超对称公司在BigBang - Proton实现跨尺度跨结构科学多任务学习,提出宇宙尺度压缩构想。文章论证其科学基础、工程可行性与意义,探讨Scaling Law边界,还给出宇宙尺度压缩计划和相关假设。
看到这个小红书卖虚拟产品获利百万的案例,我才发现AI翻译的信息差真大
作者建议AI开发者先了解大众需求再做产品。分享小红书上AI翻译变现案例,还展示智谱BigModel开放平台翻译智能体的多模态翻译案例,介绍其解决AI翻译问题的亮点及适用场景。