「探索熵机制」共找到 1548 篇相关文章
PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃
快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。
AI 唱得比顶流歌手还精准!周亚辉盛赞百倍跃进,高晓松直言:AI 和我不是一个创作机制
近日昆仑天工发布 Mureka V8 音乐大模型,昆仑天工董事长周亚辉称其标志 AI 音乐达大规模工业化应用成熟度。高晓松认为 AI 与自己创作机制不同,但也肯定其能力,当前 AI 音乐正重塑产业权益结构。
别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案
团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。
推理与操控能力双提升!具身机器人双系统VLA模型新突破
香港中文大学等联合提出Fast - in - Slow(FiS - VLA)统一双系统VLA模型,实现快慢系统融合。在真机和仿真测试中,成功率和控制频率提升显著,泛化能力强。未来计划探索动态调参机制。
Svelte 团队成员开源新框架 Ripple,又一个想“改写前端”的框架?
Ripple是全新开源前端框架,由Svelte核心维护者打造,融合多框架理念,采用TS优先设计,有细粒度响应式机制等,目标是带来更简单开发体验,团队还探索集成AI能力,目前处于早期阶段。
国产类脑大模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型
中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。
长得好看又会「看脸色」,这家具身公司不卷「干活」卷「懂你」,天使轮再获数千万战略加注
2026年具身智能转向家庭场景,深穹星核认为面向C端核心是意图理解,推出VLIA模型。其与头部公司合作获意图数据,还与星闪联盟合作推动产品落地,有三层技术护城河,探索长期陪伴机制。
斯坦福英伟达推出测试时强化学习:微调开源模型胜过顶级闭源模型,仅需几百美元
斯坦福、英伟达等提出TTT - Discover方法,基于开源模型gpt - oss - 120b,在测试阶段引入强化学习更新模型权重。它采用熵目标函数和PUCT启发机制,解决分布外问题,成本低且表现优,但目前适用于连续奖励场景。
Clawdbot开发者:未来一大批应用都会消失,提示词就是新的interface
Clawdbot开发者Peter Steinberger在采访中分享诸多观点,认为今年是「个人助理」之年,每个人应构建智能体探索记忆机制;指出GUI糟糕,多数MCP应做成CLI;还称未来大批应用会消失,提示词是新界面。
SGLang JIT Kernel 介绍
文章介绍SGLang JIT Kernel,此前开发CUDA Kernel流程繁琐、编译时间长,现基于TVM - FFI探索JIT开发加速迭代。文中梳理其机制、抽象及新增Kernel流程,还给出环境设置、目录结构等内容,并以实例说明开发过程。