架构建议流程」共找到 3027 篇相关文章

推荐文章7

图解Vllm V1系列7:使用AsyncLLM做异步推理

文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析单条请求处理流程及阶段,说明并发提升效率的方法,还提及多请求并发及构建异步推理引擎思路。

GiantPandaLLM
算法论文8

直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?

该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
产品应用8

微信自研高性能推理计算引擎 XNet-DNN:跨平台 GPU 部署大语言模型及优化实践

本文深入解析微信自研的高性能推理计算引擎 XNet-DNN,介绍其核心技术架构和性能优化策略。该引擎基于 RCI 框架构建跨平台 GPU LLM 推理能力,在多方面超越现有解决方案,还给出了详实对比实验数据。

腾讯技术工程
开源动态8

超长推理还能节省计算!Salesforce开源神器两连发:教大模型边想边省,显著提升数学编程准确率

Salesforce AI Research开源Elastic Reasoning和Fractured Sampling。前者将推理流程分两部分,分配token预算,使输出缩短、准确性提高;后者打碎推理链条,从三维度采样,以更少tokens换更高准确率,均提升数学和编程任务准确率。

量子位
新闻资讯8

华为+DeepSeek,推理性能创新高!技术报告也公布出来了

华为昇腾在部署超大规模MoE时推理性能创新高,全面超越英伟达Hopper架构。其采用‘以数学补物理’方式,还将全面开源。团队从多方面优化,在不同硬件上取得优异性能,本周还将举办技术披露周。

量子位
算法论文8

具身智能发展趋势与展望 | 中国工程科学

文章深入探讨具身智能的概念、内涵、计算框架与系统实现,梳理发展现状、趋势与挑战,强调生成式AI在其演进中的关键作用,还分析我国发展进展、风险,并给出研究方向与对策。

力学与人工智能
推荐文章7

清华东门1公里:AI原点社区的10万补贴和一天1块钱的工位

文章介绍北京AI原点社区,它2026年1月入选北京首批人工智能创新街区。这里无物理边界,三区融合,核心区16万平。企业可通过原点学堂等入驻,有补贴等资源。个人不挂靠公司也能用其资源,并给出使用建议

AI Reading Hub
产品应用7

腾讯 Hy3 一手实测,Agent 能力提升不止一点

作者拿到 Hy3 模型测试资格,介绍其架构、性能和价格优势,还在 WorkBuddy 里实测它完成运营工作、选编辑助教、开发新功能等任务的效果,最后评价 Hy3 能力、价格、适配方面的表现,并分析 WorkBuddy 领先原因。

特工宇宙
产品应用7

Codex跑了22小时,真赚16.88美元:奥特曼预言的「AI打工人」来了

开发者Chris让Codex按「去GitHub上赚5美元」指令运行22小时,几天后获16.88美元。虽流程细节缺验证,但显示Codex在特定条件有「找漏洞→提PR→跟进审查」能力,不过距真正自主赚钱仍有距离。

新智元
开源动态8

Anthropic开源认知对齐MSM

大模型对齐、安全问题是行业大事,Anthropic开源的MSM对齐方法,能将Qwen3 - 32B的agent错位率大幅降低。它先给模型讲规则逻辑再微调,控制精度高,还研究了最佳实践,将改变大模型对齐流程

CourseAI