「层级权重共享」共找到 362 篇相关文章
警钟敲响!Hinton 最新万字演讲:怒怼乔姆斯基、定义“不朽计算”、揭示人类唯一生路
Hinton在演讲中提出“凡人计算”概念,指出生物智能会随肉体消亡,而AI软件与硬件解耦可“不朽”,还怒怼乔姆斯基,认为大语言模型理解语言方式与人类相似,且数字计算在知识共享上远超生物计算。
Agent KB:经验池让Agents互相学习!GAIA新开源SOTA,Pass@1性能最高提升6.66
来自多家机构团队发布 Agent KB 框架,构建经验池实现 AI Agent 经验共享。在 GAIA 基准测试中表现出色,提升多模型 Pass@1 性能,还在软件工程领域展现价值。其设计精妙,经消融、检索策略等实验验证有效。
“AI 工程师”已上岗!微软 CEO 曝正尝试新学徒制模式:内部工程师的顶级实践全变
在达沃斯论坛上,微软 CEO 萨蒂亚·纳德拉与英国前首相聚焦 AI 应用话题。他以自身参会准备工作变化,说明 AI 打破传统层级架构。还指出企业 AI 应用有‘杠杆效应’,人才差距在应用推进力度,判断泡沫关键在于落地。
浅析 Amazon S3 Files:工作机制、性能边界与选型思路
4月7日,AWS发布新服务Amazon S3 Files,可将S3存储桶作为高性能共享文件系统挂载到计算节点。本文分析其底层实现、工作机制、性能边界,与其他对象存储文件化方案对比,指出适用场景。
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4
近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。
Thinking Machines 发布第二篇博文:用模块化流形让训练更加稳定高效
Thinking Machines实验室发布第二篇Connectionism研究文章,提出模块化流形理论框架,通过在权重矩阵施加流形约束让神经网络训练更稳定高效。文章从几何角度思考优化问题,提出流形Muon优化器,还探讨了模块化流形扩展到大型网络的方法。
Andrej Karpathy 爆火演讲刷屏技术圈:AI 开启软件 3.0,重写一切的时代来了!
Andrej Karpathy 在旧金山 AI 创业学校演讲,指出 AI 开启软件 3.0 时代,自然语言成编程接口。软件经历 1.0 代码、2.0 神经网络权重,现进入 3.0 用提示词编程大模型阶段,还探讨大模型特性、应用及相关问题。
Kotlin Multiplatform 评估:跨平台开发中的优势与权衡
文章评估了 Kotlin Multiplatform(KMP)在跨平台开发中的优劣势。KMP 可共享代码,编译成原生代码获出色性能,保留原生 UI 选项。虽生态小、有学习曲线等问题,但 Netflix 等大公司已用,未来潜力大。
NBA球星,成为英伟达副总裁
本文用一张「组织透视镜」,带你看清英伟达36人的角色分工、黄仁勋的管理逻辑,以及它对AI时代公司的启发。黄仁勋以扁平化直管36位高管,减少层级,让信息流动,使公司保持创业般的冲劲。
分割一切并不够,还要3D重建一切,SAM 3D来了
深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。