「实战能力」共找到 3382 篇相关文章
超强开源OCR,手写体识别能力超dots.ocr,封存多年的老文档数字化有救了。
文章推荐新开源的OCR系统Chandra,它对手写体识别做了优化,官方测评数据显示比dots.ocr强。介绍其适用于多场景及功能特点,还展示了不同场景的识别效果,建议有需求者多对比测试。
GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~
智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。
GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~
智谱继GLM4.5后又开源GLM - 4.5V,它是同级别开源SOTA视觉推理模型,在多模态理解榜单表现优异。文章实测其在科研全生命周期的应用,还介绍了模型架构设计和训练策略。
揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon
在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。
刚刚,LMArena最新模型榜单出炉!DeepSeek-R1网页编程能力赶超了Claude Opus 4
LMArena最新模型榜单出炉,DeepSeek - R1(0528)表现亮眼。在文本基准测试中整体排第6、开放模型中排第一,细分领域也成绩优异,在WebDev Arena平台与闭源大模型并列第一,超Claude Opus 4。
360 周鸿祎:做中国版 Mythos 不能照搬美国路线,基模能力的差距可以通过Harness补齐
过去几月,Anthropic的Mythos模型成全球网络安全焦点。360周鸿祎在ISC.AI 2026上发布‘图龙锋’和‘仪天阵’,欲做中国版Mythos,还发起‘磐石之盾’计划。他认为不能照搬美国路线,可通过Harness弥补基模差距。
25.2K Star!OpenAI 官方开源的 Claude Code 插件,可直接调用 Codex 的审查能力!
OpenAI 官方发布全新插件 codex - plugin - cc,可让 Claude Code 和 Codex 在同一工作流协作,解决开发者在多工具间切换痛点。插件有工作流无缝衔接等亮点,提供 7 个核心命令,还给出快速上手步骤。
评论送书 | Code Agent实战案例——用Pywen Agent、Claude Agent和Codex Agent从零开始构建一款网页游戏
本文展示用三大Code Agent依斯特鲁普效应构建网页游戏,对比其表现,还介绍让AI做测试方案、写文档,体现Code Agent在快速原型开发全生命周期的应用,还推荐相关书籍解答不同人群疑问。
太初元碁洪源:异构计算能力将成为未来AI算力基础设施的重要方向|AIGC2026
2026年AI产业进入高强度算力周期,Token成核心资源消耗单位。太初元碁洪源认为,AI算力需更好支撑应用,异构计算将成未来AI算力基建重要方向,太初元碁也在多方面探索实践。
OpenClaw创始人:80%的应用会消失,花哨的AI工作流只会生产垃圾,工程思维才是超能力
OpenClaw创始人Peter Steinberger表示,OpenClaw这类AI助理将取代手机上80%的应用。他分享OpenClaw诞生过程,其能远程修复Bug等。他还批判花哨AI工作流,认为人类品味不可或缺,建议学习AI要去玩。