「统一OCR范式」共找到 1475 篇相关文章
MOE RL实战:统一FP8全流程训练
SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。
Open Responses 规范实现智能体式 LLM 工作流的统一
OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片化,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。
在 BetterYeah,我看到了一种新的企业生产力范式
2025 WAIC聚焦Agent,C端个人Agent产品热闹,企业级市场落地难。BetterYeah AI获阿里云亿级融资,其解决企业难题,构建“数字同事”,即将发布的Nova Agent开启“AI数字团队”新范式。
英伟达发布统一GPU开发平台DGX Cloud Lepton
英伟达发布专为开发者设计的AI平台DGX Cloud Lepton,可汇聚全球GPU计算资源,提供即时访问和无缝部署能力。它功能强大,支持多环境部署,提供统一体验,还有庞大合作网络。
LangFlow: 挑战离散扩散,探索下一代语言模型新范式
UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。
OCR又出宠OpenDoc,速度超MinerU6倍
复旦开源的OpenOCR是面向通用OCR任务的开源平台,其OpenDoc是超轻量文档解析系统。它采用Pipeline模式,两阶段解析不易放大误差。UniRec - 0.1B有独特架构与分层监督训练等创新技术。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
生成式推荐!推荐系统新范式还是新噱头?
文章围绕生成式推荐展开,介绍其概念,探讨效果和成本问题。以Meta的GR和快手的OneRec为例,分析收益与开销,指出不同团队应用情况,认为它或带来架构革新,也提醒勿盲目跟风。
MCP Registry 预览版上线:AI 开发的统一服务目录
Model Context Protocol 推出 MCP Registry 预览版,这是开放的 MCP 服务器目录和 API,可改善服务器可发现性。注册表开源,分公共和私有子注册表,采用社区举报机制,设计类似 Docker Registry。
面向高效异构训推的统一通信库DeepLink DLSlime开源
上海人工智能实验室开源异构芯片通信库 DLSlime,作为 DeepLink 核心组件,它连接多应用和传输链路。具备异构互联、多链路支持等亮点,性能优于主流方案,已在实验室多个项目验证,还助力国产 AI 工具链发展。