「运行时学习」共找到 2442 篇相关文章
Agent学会自己「长」Skill了!从失败里长出经验,比人类写的更好用|ICML 2026
ICML 2026接收论文提出EvolveR,让Agent从自身成败轨迹自动蒸馏“经验”,经闭环生命周期形成“认知Skill”,维护经验库,用强化学习让其学会“使用经验”,在多跳问答表现优。
谷歌Gemma 4全系开源:3.8亿激活超越20倍体量模型,手机秒变AI工作站
谷歌发布Gemma 4全系列开源模型,有4个尺寸。它在硬件适配、注意力机制等方面革新,能在手机等设备运行,在测试中成绩出色,还获多平台支持,谷歌发起挑战赛鼓励开发者。
信息量爆炸!OpenAI内部路线图首次全曝光,首席科学家亲口承认:超级智能10年内到来
OpenAI宣布重组完成后,Sam Altman和首席科学家Jakub Pachocki直播公开内部路线图,称深度学习或10年内实现超级智能,还公布了AI研究目标与时间线,涉及产品、基建等多方面规划。
冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世
微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。
越可靠的AI就越人机,牛津大学:高情商模型错误率显著增加
牛津大学研究指出,训练模型变得温暖且富有同理心,会使其不太可靠且更奉承。温暖模型错误率较原始模型显著增加,对情绪上下文敏感,在用户表达情感与错误信息时失效常见。
ChatGPT上瘾,大脑萎缩47%!MIT祭出206页92图超长报告
麻省理工学院完成针对ChatGPT用户的首次大脑扫描研究,发现长期依赖大模型,学习能力下降、大脑受损,神经连接减少47%。AI提高效率或为误解,使用它是用长期思维能力换短暂效率。
【博客转载】CUDA Kernel Execution Overlap
文章讨论CUDA kernel执行重叠,指出有足够计算资源时可重叠,通过调整`blocks_per_grid`值,观察到不同并行化程度。还提到隐式同步会影响重叠,可启用`per-thread` default Stream 禁用。
狂涨 10.3k star!共享虚拟浏览器,太酷了!
今天分享项目`Neko`,是基于Docker的虚拟浏览器,用WebRTC技术服务。能在安全隔离环境上网、浏览、运行程序,适合和人共享页面,可一起观影、购物、协同工作,目前在Github获10.3K star。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
当模型成为公共基础设施,特赞如何架构企业级 Agentic AI?
当大模型成公共基础设施,企业需构建围绕业务结构的智能系统架构。特赞提出的 GEA 企业级智能体架构体系,围绕企业业务运行结构设计,能让智能体参与企业经营判断。