「深度研究能力」共找到 5121 篇相关文章
现代GPU体系结构Cache Operators行为研究
本文基于Compute Capability 8.9的L20 GPU进行实验,对NVIDIA PTX Cache Operators行为做进一步探究,验证了STG指令命中L1 Cache时执行Write Through等结论,还提出了遗留问题待解决。
独白:OpenAI前员工的深度反思
OpenAI前员工在博客分享工作体验,从文化、技术等多维度剖析公司。指出极速扩张面临挑战,文化独特,技术上用Python单体代码库、依赖Azure,还详述Codex项目诞生,认为AGI竞赛在OpenAI等三家展开。
深度洞察:AI带来的产业发展趋势
文章指出AI正以极快速度改变世界,趋势已成。探讨软件业从以应用为中心到以模型为中心的变革,还将阐述从以应用为入口到以AI为入口、AI巨头发展方向及未来展望等内容。
Claude 这个更新,让模型能力提升10%+!
Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越大。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。
重磅!翁荔最新Scaling Law深度洞察来了
北大毕业的前OpenAI高管翁荔(Lilian Weng)的《Scaling Laws, Carefully》值得一读。Scaling law是预训练预算表,能帮少烧错钱。文章探讨大模型训练预算分配,分析Kaplan和Chinchilla结论差异及数据稀缺问题。
Strix AI驱动的漏洞动态验证能力分析
传统SAST工具只能发现‘可能有问题的代码’,无法确认漏洞是否可被利用,导致高误报率。Strix采用‘静态分析 + 动态验证’的混合模式,先定位可疑点,再对漏洞进行真实攻击验证,显著降低误报率。
阿里新研究:统一了VLA和世界模型
阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。
OpenAI将上任新部门CEO,发表深度长文
Instacart首席执行官Fidji Simo将在8月18日加入OpenAI任新部门CEO,她发文阐述AI赋能人类的看法,指出要确保技术为更多人带来机遇,还详述AI在知识、健康等方面改变生活的潜力。
AI时代:判断力为何比技术能力更重要?
音乐家布莱恩·伊诺1995年指出计算机音序器把技术问题转为判断问题,如今AI时代这一洞察更凸显价值。技术壁垒消失,判断力成关键差异,未来职业将向战略判断转变。
作业帮基础观测能力之一监控体系实践
本文介绍作业帮监控体系实践。其监控体系随云原生成长,支持全集群监控。构建时选 Prometheus 采集、VictoriaMetrics 存储,还从多维度采集指标,用自研代理降成本、治理指标,让系统更贴合研发。