自动化框架」共找到 2037 篇相关文章

产品应用7

Codex自改进Prompt:让AI自己把重复工作变成自动化

开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。

AI工程化
算法论文8

代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈

ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。

新智元
开源动态8

开源PDF表单自动化神器,一行命令,把静态 PDF 变成交互表单!

平时拿到的PDF表单大多无法直接填写,操作繁琐。GitHub上的开源工具CommonForms能自动识别PDF表单区域,一键生成可填写的交互式表单,基于深度学习模型FFDNet,功能强大且使用简单,还保障数据隐私。

开源星探
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
开源动态7

多模态RAG哪家强?9 个 Embedding、4 类 MLLMs、4 大框架实景比拼

现有文档 RAG 评测存在不足,华南理工和华科推出 DOUBLE - BENCH 进行多模态 RAG 实战评测,结果显示检索是瓶颈,模型爱胡说。快手开源 Keye - VL - 1.5 - 8B,PaperAgent 有实操指南。

PaperAgent
算法论文8

首篇WebAgents综述:大模型赋能AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
开源动态8

国产GPU首获全球顶级推理框架「原生门票」:MUSA合入SGLang主线

近日,摩尔线程举办「SGLang × MUSA Meetup」,分享与 SGLang 社区及 MUSA 生态协同进展。其 MUSA 后端已加入 SGLang 官方支持体系,代码合入主线,还在多方面取得成果,众多开源项目核心维护者参与探讨国产 AI 算力。

机器之心
推荐文章7

跨OS GUI智能体基础设施白皮书——重新定义人机交互自动化|甲子光年智库

《跨OS GUI智能体基础设施白皮书》由庭宇科技和铸基计划联合发布,剖析GUI Agent市场格局、技术路径与落地场景。指出其引发人机交互革命,能突破API局限,还介绍产品形态、发展挑战等。

甲子光年
开源动态7

最受欢迎的开源大模型推理框架 vLLM、SGLang 是如何炼成的?

文章介绍了开源推理引擎 vLLM 和 SGLang,包括起源、创新、社区发展、版本迭代等。vLLM 借鉴分页缓存管理技术,SGLang 基于 RadixAttention 优化。二者竞争激烈,性能趋同,还获投资与基金会关注,受科技公司青睐。

AI科技大本营
开源动态7

隐藏超多上下文工程(Context Engineering)技巧的框架,来试一试吧!

文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。

CourseAI