「多工具调用」共找到 5568 篇相关文章
Qwen3满血版上线,第一件事就是把搜索按钮干掉了。
Qwen3-max满血版发布,去掉搜索按钮,因模型能力提升无需手动控制。它具备自适应工具调用能力,能自行判断何时使用搜索等工具,思考过程结构化,跑分接近一线模型。
在校生开发,榨干 win 系统全部带宽!
介绍在校生开发的开源工具 HypoMux,它面向 Windows,能把多张网卡「绑」在一起,让下载任务多线路并行。有双模式可选,还能智能分流,兼容主流加速器。操作简便,可解决下载慢问题。
永别了,终端!OpenAI疯狂升级Codex,接管Mac人类全程0操作围观
OpenAI的Codex迎来重大更新,从代码工具进化为通用个人助理。开发者实测中,它能接管Mac完成多项任务,人类全程0操作。还支持多应用集成,功能强大,获开发者青睐,或重新定义使用电脑方式。
打破幻觉!Qwen最新OCR让印章、表格、公式识别准确率飙升45%
基于推理增强框架的视觉语言模型处理OCR任务有成果,但存在生成幻觉问题,特定领域不如专家模型。DianJin - OCR - R1通过推理与工具交互,按‘思考 - 调用工具 - 重新思考’流程提升OCR性能,减少幻觉。
谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发数学新构造
著名数学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新数学构造,该系统结合 LLM 与进化计算,在多领域问题上表现出色,还能与其他 AI 工具结合。
让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力
上海交大等团队推出多模态智能体训练方法 Visual-ARFT,让视觉语言模型有「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在多任务超 GPT-4o。
UI-TARS-desktop:字节跳动的原生GUI智能体,用自然语言控制电脑和浏览器
字节跳动开源的UI-TARS-desktop是原生桌面GUI智能体工具,基于UI-TARS和Seed-1.5-VL系列模型。能用自然语言操控电脑和浏览器,有本地和远程两种模式,支持多平台,还对比了同类工具。
Agentic Coding表现创新高,全新KAT系列模型强势霸榜SWE-Bench
快手 Kwaipilot 团队推出 KAT 系列两款 Agentic Coding 大模型,KAT - Dev - 32B 开源,KAT - Coder 闭源。两模型在 SWE - Bench Verified 表现出色,且在多训练阶段创新优化,有强大代码生成能力和涌现现象。
《动手写AI Agent》50 行代码,你的第一个 Agent
文章教你用50行代码打造能读文件、跑命令、自主决策的AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code的对照。
双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了
主打“自动化执行、多模型调用、上下文记忆”的AI编程应用大热,但也出现运行卡顿等问题。Trae被曝过度消耗资源,Claude Code对付费用户增加调用限制,凸显AI产品资源问题及厂商成本管控困境。