「生产系统」共找到 1906 篇相关文章
英伟达发布统一GPU开发平台DGX Cloud Lepton
英伟达发布专为开发者设计的AI平台DGX Cloud Lepton,可汇聚全球GPU计算资源,提供即时访问和无缝部署能力。它功能强大,支持多环境部署,提供统一体验,还有庞大合作网络。
用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源
华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。
Agent的自演进,被刚刚开源的AReaL 2.0按下了加速键
Agent 正从「会使用工具并完成任务」向「在使用中学习并改进方法」转变,但面临自演进难题。AReaL 2.0 上线,解决 Agent 服务侧问题,给出在线学习闭环方案,其价值已在实践中得到验证。
1.5K Star!网页提取神器 webclaw:让 AI 精准抓取网页核心内容!
webclaw是专为AI工作流打造的高性能网页提取工具,能把网页转成适合大模型的内容。它有Token优化、极速响应等亮点,支持多种安装和使用方式,解决了传统抓取工具的痛点。
QCon 2026 北京站收官:以 AI 之力,重塑软件工程新生态
4月16 - 18日,QCon全球软件开发大会·北京站(2026)举办,超2000人参与。极客邦赵钰莹点明企业AI落地要点;黄东旭等专家分享见解,探讨软件变革、安全等;还有25个专题及展区展示,后续接力6月上海AICon。
OpenClaw代码越改越崩?新研究EvoClaw揭示:Agents持续开发成功率仅13.37%
USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。
跳过88%专家,保住97%性能!MoE推理的正确玩法| CVPR’26
多模态大模型走向大规模,MoE架构虽降低计算开销,但推理成本仍高。香港科技大学等团队提出MoDES,它是training - free动态专家跳过框架,能跳过88%专家还保留97%性能,推理速度提升2倍。
金山、Zilliz、腾讯、灵犀量子专家齐聚,揭秘 AI 记忆、RAG 演进与自我进化的工程实践 | AICon
2025 年构建复杂 AI 系统面临记忆缺失、检索瓶颈、认知固化等系统工程挑战,Context Engineering 是关键。AICon 北京站邀金山、Zilliz、腾讯、灵犀量子专家,分享上下文工程技术实践。
24个Agent工作流框架用哪个? 11个维度全面评测
LLM发展推动自然语言理解进步,国产LLM密集发布。文章从功能能力和架构特性两维度,对24个智能体工作流框架全面评测,给出关键结论,还提及优化策略、应用领域等。
腾讯Kuikly框架鸿蒙版正式开源 —— 揭秘卓越性能适配之旅
腾讯将广泛使用的跨端开发框架Kuikly鸿蒙版正式开源,已接入多款业务。它有高性能、动态化特点,适配中解决渲染、文本性能等问题,还优化调试效率,发布Compose DSL Beta版。