「时间相关性」共找到 1500 篇相关文章
Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好
Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。
智谱清言微服务架构转型实践——基于 CloudWeGo 的技术演进
本文由智谱清言资深后端开发工程师肖文彬整理,阐述其从单体架构到微服务体系的转型实践。随着业务发展,传统单体架构显瓶颈,智谱清言开启转型,分享挑战、架构设计、技术选型等经验,为相关团队提供借鉴。
初稿抢先看!13家单位共同起草全国首部AI大模型私有化部署标准智合标准化建设
由智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,这是国内首部相关标准。它全流程覆盖、多方面融合、三方协作,能解决企业痛点,现征集起草单位和人,5月15日开研讨会。
Agent产品,快者为王?Anthropic 和 Databrick CEO 对话解读
Anthropic和Databrick以「人工智能的未来:面向各领域的专用Agent」为主题举办线上峰会,两家公司CEO Dario Amodei和Ali Ghodsi对谈,分享Agent未来、相关合作等话题,还探讨数据价值、治理风险及AI应用迭代等问题。
AI半壁江山是中国人!黄仁勋敲警钟:美国再不觉醒就晚了
在华盛顿的Hill&Valley论坛上,黄仁勋指出全球50%的人工智能研究人员来自中国,呼吁美国加速布局AI。他还介绍了英伟达的相关计划,提出维持美国AI领导力的建议,强调了人才、资本与生态在算力革命中的重要性。
大模型之外,向量存储如何支撑 Agent 的检索链路
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
SGLang Custom AllReduce v1 与 v2 实现原理详解
文章聚焦 SGLang 里两代自定义 all-reduce 实现(v1 和 v2),前者从 vLLM 移植,后者是默认版本。详述其负载特征、前提条件、分发链、同步机制、算法及 CUDA graph 支持等内容,还对比了两代差异,并提及相关环境变量。
半年内 4 家大厂合并前端建制,全栈只是过渡答案,程序员何去何从
文章围绕大厂前端建制合并展开,介绍半年内得物、美团等四家公司的相关动作,分析前端先被合并的原因,指出现有全栈定义已变,公司采购单位转变,还提及未被压缩的方面,给出关键结论。
量子位专访楼天城:AI是匹脱缰野马,Harness是这个时代最关键的能力
量子位专访小马智行CTO楼天城,他认为AI如脱缰野马,Harness是关键能力。小马智行发布PonyWorld世界模型2.0,人类不再是中心,AI成总教练,能自我诊断和定向进化,还探讨了诸多自动驾驶及AI相关问题。
超700人预约,昆明一门店免费安装!不少线下数码门店迎来大量用户,“小龙虾”火爆出圈!
一款名为OpenClaw的AI智能体因图标是红色卡通龙虾被称为“小龙虾”而火爆。昆明线下数码门店有用户咨询、预约安装,超700人预约。它能自动完成操作,但存在技术门槛和数据安全风险,国家相关部门已发布提示。