「可解释性综述」共找到 4153 篇相关文章
首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26
研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。
解放双手!开源 AI 桌面智能体
桌面智能体Bytebot是拥有专属计算机的人工智能,有完整虚拟桌面。它能使用任意应用、处理文档等。赋予AI独立计算机可解锁新能力,项目地址为https://github.com/bytebot-ai/bytebot。
登顶AndroidWorld开源榜首!可以操作手机的移动端AI Agent。
Minitap开源的手机Agent登顶AndroidWorld开源榜首,亮点是能操控安卓与iOS模拟器。用户用自然语言就能完成复杂任务,还具备跨平台控制、全场景交互等特点,项目可快速部署。
OpenAI 新的学习模式的系统提示词
本文介绍OpenAI新学习模式的系统提示词,包括严格规则,如了解用户、温故知新等,还说明了可做的事,如教授新概念、辅导作业等,强调语气方式及不要直接给答案。
ACL 2025 Oral | 你的模型评测搭子上线:Evaluation Agent懂你更懂AI
上海人工智能实验室与新加坡南洋理工大学合作研发 Evaluation Agent,它能按需评估视觉生成模型,有可定制、高效率等优势。框架分提案和执行两阶段,评估结果佳,未来将拓展功能。
让 AI 推荐美食,字节悄咪咪上线“AI 版美团”
字节跳动悄然上线AI产品「探饭」,可在抖音小程序体验。它能智能推荐美食餐厅,有AI问答、评价总结、点菜等功能,餐厅信息全,支持团购和外卖,还能比店PK。
刚刚,Anthropic官方Harness被LangChain悄悄开源了~
上周,Anthropic发布官方Harness:Claude Managed Agents,但它闭源。LangChain则发布Deep Agents Deploy的Beta版本,是开源、模型无关的Agent框架,可用于生产环境,部署步骤被打包成一个命令。
AI生的图能分图层,Agent控制能力进入下半场
Lovart上线Layered Image Editing功能,可自动识别图片里的文字、主体、背景并拆成独立图层,每个图层能单独编辑。其还有快速模式,模型库更新快,能降低AI生图门槛。
谷歌版小钢炮开源!0.27B大模型,4个注意力头,专为终端而生
谷歌开源Gemma 3 270M,几分钟就能完成微调,性能超Qwen 2.5同级模型。此模型小巧高效,可本地运行,还能用它构建OCR应用。它有多项亮点,适合多场景,上手简单。
给AI全局记忆
作者认同OpenAI‘全局记忆’观点,称其能提升对话连贯性,实现AI成个人助理愿景。介绍OpenMemory项目可存储调用记忆,还提及实现功能的三点做法,看好创业者在该领域机会。