「Keye-VL 1.5」共找到 3271 篇相关文章
OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力
主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态大模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。
扩散语言模型扛把子LLaDA迎来新版本,数学、代码、对齐能力均提升
中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。
有人把 Opus 4.6 换掉了,成本省了 97%
智谱开源 GLM - 5.1,数小时获两百万 + 阅读,海外反应更热烈。它在多个编码基准测试成绩优异,如 SWE - Bench Pro 全球第一。还能完成长程任务,有开发者已用其替换 Opus 4.6 节省成本,但速度问题待解决。
OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力
主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。
刚刚,蝉联Future X全球榜首的MiroMind发布全球最强搜索智能体模型
由陈天桥和代季峰联合发起的 MiroMind 团队,于 1 月 5 日发布自研旗舰搜索智能体模型 MiroThinker 1.5。该模型参数规模小但性能强,其核心是「发现式智能」理念,还采用了新训练技术,有 A 股涨停板预测等应用。
群核科技开源两款空间大模型,想解决 Genie3 没能彻底解决的问题
2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间大模型,开源SpatialLM 1.5和SpatialGen。两款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。
GPT-6最大的升级,是每天送你一张免费重置卡。
GPT - 6刷屏,虽不能马上给用户用,但跑分碾压,似被fable5.1逼出。重置义父想出每天送一张重置卡的补偿办法,口碑反转。OpenAI还更新订阅额度限制,token变贵,很多公司开始适应峰谷定价。
国产开源LLM迎来大爆发的一周:Kimi、腾讯、快手、美团、面壁智能
国产开源大模型迎来爆发,快手、月之暗面、美团、面壁智能、腾讯等接连发布新模型,如快手Keye-VL - 1.5 - 8B刷新视频理解SOTA,美团LongCat - Flash - Chat推理快成本低等。
最新外国「自研」大模型,都是套壳国产?
本周,Cursor发布新代码模型Composer,Cognition推出新AI模型SWE - 1.5,二者均被指背后基于中国AI模型。业界大佬认为有证据指向中国开源模型,国产开源模型已成AI领域主流,改变全球竞争格局。
最强开源0.9B级OCR模型!本地Agent、知识库都有救了!
百度飞桨PaddleOCR团队开源多模态文档解析模型PaddleOCR-VL,参数量仅0.9B,对算力要求低。它在OmniDocBench V1.5榜单屠榜,经测试,能精准识别发票、图表等,适合本地环境与资源受限设备。