「统一OCR范式」共找到 1480 篇相关文章
瞄准AI、图形顶端战场:摩尔线程上演国产GPU硬核实力路演
摩尔线程首届 MUSA 开发者大会集中亮相技术体系。发布新一代统一计算架构 MUSA 路线图,介绍新架构、芯片及万卡集群,还涉及前沿布局,发起开发者培训,推出 AI 算力笔记本,宣告国产算力自主化时代加速到来。
NeurIPS 2025 | 告别全量扫描!浙大提出COIDO:破解多模态数据选择「高耗」难题
浙大提出 COIDO 框架解决多模态数据选择「高耗」难题。它摒弃全量扫描,用轻量级评分器和小样本采样,将重要性和多样性的优化统一。实验显示,它性能与效率双优且有强泛化性。
沈向洋解读AI演进五大维度!IDEA研究院发布“万物可抓取”模型,GPU渲染器打破国外垄断
沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物可抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染器Smart等创新成果。
别问树模型了!死磕结构化数据,清华团队把大模型表格理解推到极限
AI 时代处理结构化数据成痛点,LLM 大模型难以满足生产要求。清华大学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。
宇宙尺度压缩:Scaling Law的边界,柏拉图表征收敛于物质和信息交汇,解决P与NP问题,Simulation假说……
超对称公司在BigBang - Proton实现跨尺度跨结构科学多任务学习,提出宇宙尺度压缩构想。文章论证其科学基础、工程可行性与意义,探讨Scaling Law边界,还给出宇宙尺度压缩计划和相关假设。
舍弃 VAE,预训练语义编码器能让 Diffusion 走得更远吗?
纽约大学谢赛宁团队、清华&快手 Kling 团队的研究者指出 VAE 制约当前 Diffusion 范式,提出用预训练视觉模型作语义编码器改进。介绍了 VAE 不足及 RAE、SVG 工作如何解决问题,将扩散模型从‘压缩优先’转为‘语义优先’。
还在拼命加 GPU?AI 应用规模化的下半场,拼的是这五大软件“新基建”
文章指出 AI 应用规模化下半场,拼的是五大软件“新基建”。从云原生到 AI 原生,应用基础设施面临诸多挑战,如从代码中心到智能体管理等。作者提出构建智能体协作网格、认知记忆平台等五座技术灯塔,助力 AI 原生应用发展。
IDC 最新AI Infra报告解读|AI 云爆发的背后:AI 应用全球化势不可挡
近期 IDC 发布报告,显示亚太企业 GenAI 应用增长快,AI 产业从开发到应用落地。这催生 AI 原生云,GMI Cloud 等新兴厂商崛起。同时,企业面临算力管理成本高问题,推理需求重塑市场格局,为中企出海带来机遇。
稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow
本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。
国产游戏理解模型刷新SOTA,对话逗逗AI CEO:开源模型+行业数据是突破关键
2025年末国产开源模型影响力凸显,东京电玩展上逗逗AI的游戏理解模型LynkSoul VLM v1超顶尖闭源模型。其CEO刘斌新表示,开源模型结合行业数据是突破关键,还探讨了产品技术、交互及发展趋势等。