「自适应工具使用」共找到 2916 篇相关文章
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
用AI写PPT,没想到效果这么好啊
文章聚焦用 CodeBuddy 写 PPT,先指出写 PPT 的痛点,介绍 CodeBuddy Skills 解决方案,接着阐述安装、实战场景、使用技巧,深度剖析 PPT Skill 原理、架构等,最后说明优势与局限,助力摆脱 PPT 难题。
首个自主数据科学的智能体
DeepAnalyze是业界首个能自主完成数据科学任务的智能体大语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。
OpenAI最新开发者“全家桶”:Apps SDK、Agent Builder、ChatKit深度解读与实测
长假期间,OpenAI在2025 DevDay宣布开发者生态重大升级,引入“Apps in ChatGPT”及其SDK和AgentKit工具集。文章深度解读Apps SDK、Agent Builder、ChatKit,介绍功能、使用方法和体验,还提及OpenAI的AI大平台战略。
综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满
该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。
Linus一句话说透Al局限:代码不能直接用,bug只能创可贴式地修
本文是 Linus Torvalds 在开源技术会议上与 Dirk Hohndel 的对话。Linus 从工程实践出发,谈到 Linux 内核开发节奏、硬件支持取舍、语言之争及 AI 应用。他认为 LLM 是工具,有价值但无法替代长期维护者经验。
Claude 吞噬整个AI编程栈?“Vibe Coding 公司的最大错觉是以为自己有护城河”
近日网友爆料Anthropic开发类似Lovable功能,可构建全栈应用。此前Claude Code源码泄露,展示其构建软件开发全流程“执行层”能力。AI编程进入“大收割时代”,模型厂商吞噬工具趋势显现,Lovable等平台护城河受挑战。
从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式的转移
作者分享了从单 Agent 协作到多 Agent 协作的编程范式转变。当前主流 AI 开发多为单 Agent 协作,效率低,作者设计了 Mexus 工具,解决多 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。
什么Excel这函数那公式,我千问永远一步搞定
市面上能直接交付Excel表格的AI助手少,千问悄悄升级解决了这一难题。其新上线的表格Agent功能强大,能对话生成、拍照生成、文件转Excel等,且全渠道免费用,降低了AI使用门槛。
Fable 5 订阅权限又续了 5 天!与其被吊着,我找了个账单只有 1/3 的替代方案
Anthropic将Fable 5订阅权限延长至7月12日,但使用不稳定且价格贵。作者介绍OpenSquilla 0.5.0 Preview,其多模型集成协作方案用国产模型组队,成本低且分数可与Fable 5打平,不过也有适用边界。