动态结构化知识流」共找到 1276 篇相关文章

推荐文章8

Andrej Karpathy最新万字采访:AGI还需10年,RL其实很糟糕,AGI不会导致经济大爆发

Andrej Karpathy在两小时万字采访里阐述AI观点。他认为AGI还需十年,强化学习糟糕,其不会带来经济爆炸式增长。还分享创办Eureka的愿景,想构建“知识斜坡”,让人类在AI时代有更强认知力。

AI寒武纪
开源动态7

SGLang JIT Kernel 介绍

文章介绍SGLang JIT Kernel,此前开发CUDA Kernel流程繁琐、编译时间长,现基于TVM - FFI探索JIT开发加速迭代。文中梳理其机制、抽象及新增Kernel流程,还给出环境设置、目录结构等内容,并以实例说明开发过程。

GiantPandaLLM
开源动态8

Qwen3-Next:迈向更极致的训练推理性价比

文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。

通义千问Qwen
推荐文章8

想成为一名合格的 AI PM,先抛弃过去那些让你成功的经验

文章指出 AI 产品经理与传统产品经理不同,AI 是会演进的系统。掌握 AI 产品策略是 PM 首要技能,从方向、差异化、设计、部署、领导力五阶段构建策略,还介绍了结构化实验方法,无策略的 PM 将被淘汰。

Founder Park
推荐文章7

规范驱动开发落地经验谈:为什么 AI 编程的关键不在模型,而在协作方式

文章指出 AI 编程关键在协作方式,规范驱动开发(SDD)应运而生。它有诸多价值,但落地面临工具短板等挑战。企业可将其适配现有工作流,长远看需将规范作为动态指南,实现智能体编排开发的质量转变。

AI前线
新闻资讯7

AI 狂潮中,电子业破局:国产先进封装加速突围

AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。

芯师爷
算法论文8

一种基于滑动层合并的高效深度修剪大模型的方法

文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。

机器学习AI算法工程
推荐文章8

Agent Skill规范、构建与设计模式

文章深入解析 Agent Skill 的规范、构建与设计模式。介绍了 Skill 规范标准、三层渐进式加载机制和触发机制,阐述了 Skill-Creator 和 Writing-Skills 的核心思想,还总结了 Google 的 5 种 Skill 设计模式,最后指出 Skill 生态已形成完整知识体系。

阿里云开发者
产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。

量子位
算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像。

AIGC开放社区