「论文Skill」共找到 1341 篇相关文章
7.5K Star!HKUDS开源AI全栈开发框架,产品经理的Demo神器!
AI时代从论文到产品Demo开发全链路工作耗时费力,现有Agent也有诸多问题。香港大学数据科学实验室(HKUDS)开发的DeepCode开源框架,定位“全自动AI软件开发框架”,可一键从论文/需求生成完整项目,已获7.5K Star。
出了两道真题考 GLM-5.2,Opus 4.8 和GPT 5.5 陪跑
作者对GLM - 5.2、Opus 4.8和GPT 5.5进行两项测试。一是审计Skill体系,GLM - 5.2覆盖skill数多、找出冲突多,还挖出bug;二是做世界杯夺冠推演器网站,Opus表现出色,GLM - 5.2省token,Codex有巧思但结构有缺陷。
刚刚,Anthropic这篇论文上了Natrue
Anthropic关于“潜意识学习”的研究发表于《Nature》杂志。研究揭示大语言模型能通过与语义无关的数据传递行为特征,如偏好、不对齐行为等,还探究了其机制,并在MNIST上验证。
从科学论文自动生成视频
该项目解决学术演示两核心问题,用智能体PaperTalker生成视频,还设Paper2Video基准评估。介绍了PaperTalker使用步骤,含环境、配置、推理,也说明了Paper2Video评估指标及运行方法。
Hermes推出Curator功能:自动清理Skill 仓库
Hermes推出Curator功能解决技能仓库膨胀问题。它每7天(可配置)自动运行,检查技能使用频率等数据,将30天未用技能标记为‘stale’,90天未用的移至归档目录,还能建议技能合并方案。
告别死记硬背!SkillRL自动提炼Skills持续进化
大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。
一篇19种自进化Agent Skill框架最新综述
这篇来自Rutgers大学和UNC Charlotte的survey,首次系统梳理Agent技能的进化与评估全貌,覆盖19种技能进化方法和10个评估基准。指出当前评估体系有诸多不足,如无法追踪技能多轮反馈后是否变好等。
Anthropic最新论文:检测LLM内省意识的方法
Anthropic与MIT等研究表明,LLM能‘感知’被注入的steering vector,‘内省意识’在DPO等后训练阶段涌现。研究构建实验,发现内省能力行为稳健、检测非简单线性关联等,还揭示检测与识别机制不同及两阶段电路。
糟糕,大佬45年前论文,被判AI生成
随着AIGC增多,AI内容检测需求迫切,但表现远不及预期。如作家Adam Kay、教授Devi Sridhar等多人的作品被误判,原因或是AI用人类内容训练,使判断边界模糊。
Virustotal对OpenClaw恶意技能(Skills)的跟踪分析
增长最快的个人人工智能代理生态系统OpenClaw沦为恶意软件新传播渠道,VirusTotal检测到数百个OpenClaw技能存在恶意行为。其介绍了OpenClaw相关信息,还提及新增支持及案例,最后给出安全建议。