「Docusaurus 3.9」共找到 2205 篇相关文章
最强开源0.9B级OCR模型!本地Agent、知识库都有救了!
百度飞桨PaddleOCR团队开源多模态文档解析模型PaddleOCR-VL,参数量仅0.9B,对算力要求低。它在OmniDocBench V1.5榜单屠榜,经测试,能精准识别发票、图表等,适合本地环境与资源受限设备。
刚开源仅3天狂揽4.9K star,轻量超高效版OpenClaw,10美元硬件就能跑!
OpenClaw火遍全网但硬件要求高、成本不菲。新开源的PicoClaw是其轻量替代方案,由Sipeed开发,内存占用少、启动快、成本低、便携性强,安装简单,功能多样,刚开源就成热议新星。
Qwen 3.5 的口碑持续走高,林俊旸辞职出走,开源阵营震荡
3月4日,通义千问首席研究员林俊旸宣布辞职,多位核心骨干也一同离开。此前Qwen 3.5系列开源表现出色,此次人员变动引发社区震动。大厂战略与技术路线拉扯,人才流动成常态。
Mistral 发布 OCR 3,提升了手写及结构化文档识别的准确率
Mistral 发布 OCR 3,在多种文档类型上精度更高,超越前一代产品。能提取文本、识别图像并保留文档结构,输出 Markdown 格式。早期用户认可其性能和多语言支持,生产部署扩展快,价格有优势。
「双线实测」Qwen 3.6-Plus,Agentic Coding 已经这么能“扛活儿”了?
4月7日阿里云通义千问Qwen3.6-Plus上线,作者用两套真实复杂任务评估其智能体能力。结果显示它在复杂决策和编码任务表现出色,有工业级交付水准,但也有首字延迟等短板,且参数效率优势明显。
0.9B跑出90%真机成功率!上海交大为VLA补上空间感
上海交大MINT团队提出中间路线Evo - Depth,约0.9B参数,不额外增硬件负担,兼顾仿真与真机性能及部署效率。系统由IDEM、SEM等组成,代码等已开源。
Claude半个月连崩7次!全球宕机3小时,强制实名精准封号
Claude半个月内7次大规模故障,全球宕机3小时,开发者破防。原因是Anthropic算力储备告急,为自救拟自研芯片。此外,Anthropic还通过改定价、加闸、实名验证等措施控制成本。
吞下17亿图片,Meta最强巨兽DINOv3开源!重新定义CV天花板
Meta训出70亿参数「视觉巨兽」DINOv3并完全开源。它用自监督学习,无需人工标注,可生成强大图像特征,在多任务超专用方案,NASA已用其探索火星,还能推动多行业进步。
实测updream预演台:一张图,换来一整个3D片场!
作者实测updream预演台,它可传图自动重建3D白模场景,可摆人物、调机位等,再配合Seedance 2.5渲染成片。作者还做了对照实验,证明白模能锁定拍摄意图,并给出使用建议。
单机H200最快DeepSeek V3和R1推理系统优化秘籍
作者从开源技术分享角度,盘点SGLang对单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。