数据系统逻辑架构」共找到 4186 篇相关文章

算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
开源动态7

Arch Gateway: AI Gateway的前瞻选择

AI Agent开发易陷入复杂维护困境,借鉴云原生思路,一些云原生产品朝着AI gateway进化。介绍开源项目Arch Gateway,它是AI原生gateway,具备智能路由、工具调用等能力,能让开发者专注核心业务逻辑

AI工程化
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
推荐文章7

下一代搜索:通过 MCP 实现 AI 与 OpenSearch 的融合

本文探讨 MCP 如何在 AI 代理和 OpenSearch 间建桥梁,创建智能搜索应用。介绍搜索从关键词到代理的演变,还通过电商、可观测性等场景演示代理搜索实践,显示 MCP 与 OpenSearch 结合能带来上下文感知的智能数据访问体验。

InfoQ
开源动态8

英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4倍

北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。

机器之心
8

小米双模型正式开源!MiMo-V2.5-Pro无中断肝出“macOS”:54个应用全开、浏览器真能冲浪

小米MiMo-V2.5系列模型正式开源,权重全量开放。该系列含四大模型,综合实力对标国际顶尖水准。MiMo-V2.5 Pro能力出色,如4小时无中断完成“macOS”系统,且Token效率高省成本。小米还推出开发者扶持计划。

量子位
产品应用8

全域感知,一键部署:“星元智能体”开启国产AI落地新范式

4月29日,数字感知芯片技术全国重点实验室联合中星微团队发布‘星元智能体’。它基于XPU芯片,完成从芯片到智能体跨越,架构创新破算力瓶颈,还破解数据困局,已在多地试点,未来将推动AI产业发展。

芯师爷
算法论文8

Pipeline MinerU真快不行了

文章聚焦Infinity-Parser,指出它把OCR从‘做识别’推进到‘做结构’。它采用layoutRL强化学习框架,结合真实与合成数据构建Infinity-Doc。跑分强且复杂结构表现优,透露Document AI向结构化生成转变趋势。

CourseAI
开源动态8

目标更重要?国内公司超越Generalist,进化到动作中心世界模型

具身智能圈被Generalist CEO长文刷屏,其称目标比工具标签重要。但国内极佳世界未停于概念争辩,开源“以动作为中心的世界模型”GigaWorld - Policy,重构具身智能底层逻辑,在多方面表现出色。

机器之心
算法论文8

CVPR2026 | Streamo:让大模型变成实时流式交互助手

香港浸会大学联合腾讯优图实验室提出 Streamo,将‘何时回答’变为模型预测的 token,通过端到端训练框架把离线视频模型转化为实时流视频助手,还构建 Streamo - Instruct - 465K 数据集,实验效果良好。

机器之心