「元学习」共找到 1997 篇相关文章
sglang 源码学习笔记(二)- backend & forward 过程
本文深入解析sglang forward核心实现全流程,介绍了forward传递过程、AttentionBackend数据结构,以flashinfer为例展开分析,还说明了cudaGraphRunner初始化、Capture、Replay过程,助读者理解代码。
单季利润2610亿元!三星的“AI印钞机”,火力全开
4月7日三星公布一季度业绩,营业利润57.2万亿韩元,DS部门贡献超七成。HBM业务营收大增,通用DRAM量价齐升。三星从HBM3E追赶者成HBM4领先者,但产能转移致产业链裂痕,下游产品纷纷涨价。
两个95后华人,搞出硬件版Clawdbot,售价1700元
本文介绍硬件版OpenClaw——Distiller Alpha,其核心计算基于树莓派CM5,集成多设备,能和Agent对话,可Vibe coding。量子位采访创始人叶天奇,探讨软硬一体Agent、OpenClaw优缺点、硬件创业等问题。
改变强化学习范式,Meta新作呼应Sutton「经验时代」预言
图灵奖得主等提出AI智能体将迎「经验时代」,但训练面临挑战。Meta研究用「早期经验」范式解决问题,包含隐式世界建模和自我反思,提升了智能体任务成功率和泛化能力。
The Batch: 873 | 通过自监督学习实现更好得图像处理
Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。
好奇心之旅:Cursor代码库索引机制的学习笔记
作者作为高德信息工程团队AI先锋队一员,日常用Cursor开发,因好奇其代码库索引机制展开探索。介绍了Cursor索引工作流程、隐私安全等,还研究Merkle树、turbopuffer向量库及开源方案Continue。
苹果出手!改进GRPO,让dLLM也能高效强化学习
苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。
千元手机也能离线爽跑谷歌Gemma 4,太酷了!
谷歌推出开源APP `Google AI Edge Gallery`,可在手机离线运行开源大模型,如Gemma 4。它数据不出本地,玩法多,支持中文交互。虽有局限,但已超模型演示范畴,展示AI本地智能趋势。
最高吸金30亿元!2026年半导体融资热点将涌向何方?
2026年1月国内半导体投融资活跃,共13起重点融资事件。资本不再仅投向成熟产品国产化,而是押注能定义未来架构的RISC - V、Chiplet等,还关注芯片设计上游环节。文中介绍了润芯微等多家企业的融资情况。
强化学习新发现:无需数学样本,仅游戏训练AI推理大增
莱斯大学、约翰斯・霍普金斯大学和英伟达研究团队有颠覆性发现,让多模态大语言模型玩简单游戏,无需数学样本,就能显著提升其多模态推理能力。提出的ViGaL方法在多个基准测试中表现出色。