「算子库」共找到 296 篇相关文章
“天下苦CUDA久矣!”KernelCAT率先掀桌,实现国产芯片无痛适配
中国AI产业与英伟达GPU及CUDA生态深度依赖,国产AI根基脆弱。KernelCAT作为AI Agent,能开发高性能算子,在昇腾芯片调优测试中表现出色,还能让国产模型在昇腾芯片上高效部署,实现35倍加速。
Harness Engineering 为什么是 Agent 时代的“控制论”?
本文是 George Zhang 对 Harness engineering 的解读。OpenAI 提出新工作方式,让 agent 编码,引发讨论。从瓦特调速器到 Kubernetes 再到如今的 harness engineering,本质都是控制论模式。LLM 或使代码库反馈回路在关键决策层闭合,但校准传感器和执行器是难题。
Container Use:一种用于独立的并行编码代理的新工具
Dagger团队发布开源工具Container Use,为AI编码代理提供容器化沙箱和Git工作树,实现无冲突并行工作流。它能创建隔离开发环境,让开发者在同一代码库安全运行多代理。不过该工具尚处早期,有不足。此外还介绍了其他类似工具。
AMS最新AI4PDE综述:清华大学冯西桥教授团队白金帅等提出面向计算力学中物理和数据引导的AI框架的未来
本文综述人工智能赋能计算力学框架发展与现状,指出纯数据驱动、物理信息神经网络和算子学习方法虽有潜力,但在鲁棒性等方面有挑战。阐述四个研究方向,为复杂物理系统建模等开辟新途径。
Claude Code之父红杉演讲震撼全场! 26年未写1行代码, 电脑都不开了
Claude Code之父Boris Cherny在红杉AI Ascent 2026大会上称,2026年至今未写过一行代码,现用手机工作。他预言编程已被AI解决,Claude Code代码库一年后或只剩100行,还认为软件业将民主化,创业公司迎来黄金时代。
Transformer 中的专家混合模型 (MoE)
文章介绍Transformer中专家混合模型(MoE),它能解决稠密模型扩展瓶颈。阐述其优势,如计算高效、适合并行等,还介绍在transformers库中支持稀疏架构的演进,包括权重加载重构、专家执行后端、专家并行及训练方案。
告别传统存算分离,AI时代数据底座迎来全新底层逻辑
文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计算模式等。还探讨底座升级条件、存储挑战、算子价值及未来标准层等内容。
Claude Code 起源:一个人的副业换歌脚本,变成最强 AI 编码工具
很多人以为Claude Code是Anthropic规划已久的大项目,实则最初是个人副项目。工程师Boris Cherny为熟悉API做了听歌脚本,后经改进让Claude能读文件、探索代码库,其在公司内部疯传,最终发布并发展成完整产品。
Memento-Skills VS OpenClaw 不改模型也能进化
Memento - Skills让AI Agent自己设计自己,通过部署时学习进化,不动模型参数,将经验写进技能库。经测试,在HLE和GAIA基准测试中准确率大幅提升,与OpenClaw等定位不同,有多种部署方式,不绑定模型。
RAG技巧与底层代码剖析
文章深入剖析 RAG 技巧与底层代码,从用 Python 基础库构建 RAG 系统,到多种优化方法如上下文增强检索、添加上下文块标题等,还涉及查询改写、重排序等技术,最后介绍了上下文压缩、反馈机制等提升系统效率和质量的方法。