部署时学习」共找到 2574 篇相关文章

推荐文章8

CUTE DSL学习笔记一 CUTLASS 4.3.5 CuTe DSL 文档翻译

本文是 CuTe DSL 4.3.5 文档翻译,介绍了其核心概念、使用方法、与 CUTLASS C++ 关系等。它通过 Python DSL 降低 CUDA Kernel 开发门槛,支持 JIT 编译、多种架构,还说明了当前限制与未来计划。

GiantPandaLLM
产品应用8

1分钟跑出数百预测!WeatherNext 2把短预报带入小

谷歌DeepMind发布WeatherNext 2,能1分钟从同一初始场生成上百种未来,分辨率达1小级,超上一代。它已接入Search等,重写天气预报逻辑,让预测从确定变多可能,还将改变气象体系。

新智元
新闻资讯8

AI 工程化进行:当上百个专家探讨“落地”这件事

10月23 - 25日,QCon全球软件开发大会·上海站(2025)举办,超1300人参与。极客邦科技创始人霍太稳称AI进入‘深水区’,工程化落地是关键。多位专家演讲,探讨AI基础设施、智能体等话题,27个分论坛覆盖AI工程化全链路。

InfoQ
算法论文8

AGI前夜重磅:RL突破模型「认知上限」,真·学习发生了!

AI研究圈争论RL能否赋予模型超越基础模型的推理能力。UC Berkeley等团队提出DELTA框架,观察到“RL grokking”现象,还设计新任务验证,提出两阶段奖励调度,总结两种模式等,为争论带来新依据。

新智元
算法论文8

稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow

本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。

机器之心
算法论文8

从「会说」迈向「会做」,LLM下半场:Agentic强化学习范式综述

过去LLM训练多依赖PBRFT范式,但局限明显。2025年初起,Agentic RL新范式受关注。此综述论文梳理该方向,覆盖500+研究,构建理论框架,讨论未来挑战,助LLM从「会说」迈向「会做」。

机器之心
开源动态8

阿里开源AgentScope 1.0,多智能体从开发到部署一条龙服务

大语言模型发展下,多智能体系统开发面临诸多难题。阿里通义实验室开源AgentScope 1.0框架,以开发者为核心,有三层解耦架构,模块化设计,还解决安全和管理问题,在工程化特性上优势明显。

AIGC开放社区
新闻资讯7

当未经检查的自动扩缩造成 12 万美元的云支出

Reddit 上一个云成本恐怖故事引发热议,一集群遭 DDoS 攻击自动扩展,72 小产生 12 万美元账单。Zero Cloud Waste 创始人给出预防措施,各方也发表看法,凸显需 FinOps 战略配合自动扩缩。

InfoQ
新闻资讯8

从概念到生产级部署:AWS如何破解Agentic AI落地难题?

红杉美国合伙人预测2025年是AI agent元年,但此前Agentic AI落地难。AWS在纽约峰会推出系列产品,如Amazon Bedrock AgentCore等,完成从存储到市场的升级,有望推动企业构建Agentic AI。

InfoQ
推荐文章7

最新 AGI 暴论:强化学习的「GPT-3 刻」实现,还需要 1 万年?

国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3刻”,但需数千至上万年“模型处理任务所用间”训练。还提出“复制训练”新范式,能磨炼模型能力,补足短板。

AI科技评论