当下的力量」共找到 10624 篇相关文章

开源动态8

一个只有70行文件,凭什么拿下GitHub 10万星?

GitHub上‘andrej - karpathy - skills’项目爆火,核心是不到70行CLAUDE.md文件,给出AI编程助手行为准则。其火原因有解决痛点、名人背书等,价值在于证明‘上下文工程’重要。

AI Reading Hub
产品应用8

基于AI大模型故障诊断与根因分析落地实现

文章围绕基于AI大模型故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。

阿里云开发者
产品应用8

京东AI「结果」:深度应用已成当下,万亿生态瞄准未来

9月25日,“2025京东全球科技探索者大会”展示了京东AI深度应用成果。京东发布全新JoyAI大模型及三大AI产品,展示其在多场景应用,还升级多个平台,未来三年将投入带动万亿规模AI生态。

机器之心
推荐文章8

CUDA-MODE第77课课程笔记:用于GPU kernelsDSL

该课程笔记由Tri Dao介绍GPU kernel开发DSL生态,涵盖PyTorch、Triton、Cute - DSL等。提出计算效率评估公式,对比不同DSL在Softmax、GEMM等操作性能。还提及其他DSL工具与Triton扩展项目,并给出使用建议。

GiantPandaLLM
产品应用8

AI 集成智能 Profiling 实践:从性能分析到优化闭环

本文由韩钦亭撰写,分享了在已有 Profiling 平台引入 AI 智能辅助模块实践。介绍了设计思路、工程实现、应用成效,对比不同大语言模型,通过实际案例展示优化效果,还探讨了 AI 在性能优化场景未来潜力。

InfoQ
开源动态8

没想到,最Open开源新模型,来自小红书

向来低调小红书昨日开源首个自研大模型 dots.llm1,它是中等规模 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
算法论文8

年前看到最有深度AI下半场Agents记忆机制综述

本文是一篇83页基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。

PaperAgent
算法论文8

马斯克惊叹!DeepSeek和Kimi先后出手,捅破了Transformer「潜规则」!

文章介绍了DeepSeek和Kimi在残差连接上突破。DeepSeek让连接权重可学习,用数学约束保证稳定性;Kimi将注意力机制用于层间连接,解决了更根本问题,性能提升显著。

花叔
算法论文8

将注意力旋转 90 度!今天,Kimi 「注意力残差」火了

Kimi团队发布技术报告Attention Residuals,用依赖输入注意力机制取代标准深度递归,解决传统残差连接信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。

机器之心
产品应用7

深入体验 A2A SDK:一步步教你构建“服务化” Agent 系统

文章基于A2A最新Python - SDK,介绍将LangGraphAgent通过A2A协议对外暴露并服务方法,涵盖核心架构、概念、交互流程,以及A2A Server端、Client端实现和测试总结,还提及A2A优势。

AI大模型应用实践