数字工具操作」共找到 2670 篇相关文章

开源动态8

红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用

红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。

Founder Park
算法论文7

Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了

随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。

机器之心
产品应用8

打通企业智能化最后一公里,腾讯云做了一件关键事

腾讯云在全球数字生态大会发布智能体开发平台3.0,它是整合多能力的完整平台,能帮企业快速打造数字员工。新版本解决诸多痛点,还展示多个成功案例,腾讯云也在加码开源。

鲸选AI
算法论文8

自适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式自适应路由,实现模式自适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
开源动态7

Tank OS:红帽首席工程师把OpenClaw打包成可启动的Linux设备

红帽首席软件工程师Sally O'Malley在GitHub发布开源工具Tank OS,它用bootc技术将Fedora Linux和OpenClaw打包成可启动容器镜像。该工具解决OpenClaw配置安全问题,适合企业环境,虽非面向小白,但对企业IT重要。

AI工程化
开源动态7

写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾?

libGDX 创始人、17 年开源老兵 Mario Zechner 吐槽 Claude Code、OpenCode 等工具功能堆叠,带来掌控感丧失等问题。他推出极简主义编程 agent pi,仅含四种工具,有最短系统提示词,扩展性强,能让开发者重拾掌控权。

InfoQ
开源动态7

12K Star 的 claude-seo:免费 SEO 审计能替掉哪些付费工具

2026年2月底GitHub上claude - seo仓库有3500 star,五个月后达12.3K star。该项目作者一人开发,能给站点做SEO审计。它把判断层抽出开源,审计后可直接改代码。不过也有动态渲染弱等问题。

AI Reading Hub
产品应用8

秘塔AI放大招!「边想边搜边做」,内置20+智能体,想法一键实现

在AI浪潮下,搜索正经历重构。秘塔AI推出「Agentic Search」模式,「边想边搜边做」,可自主完成多步工具调用,内置20余种工具。通过5个场景展示升级,从读懂用户到美化结果、精准计算、打通工作流等,让搜索进化为「帮达成」。

新智元
产品应用8

10亿国民App丝滑升级AI应用!高德携手通义重构的底层架构曝光

高德用AI重构底层技术栈,建立主 - 从Agent架构,将千问大模型与空间智能结合。新架构分Agent层、模型层和工具层,还依托生态数据和通信协议。这让高德从工具变智能体,为行业转型提供范式。

量子位
产品应用7

设计师的 ChatGPT 时刻:Figma 这次把“设计即代码”玩成现实

文章介绍了AI编程产品分类,指出Vibe Coding存在的问题。重点讲述Figma在2025 Config发布Vibe Coding产品Figma Make,其可从设计稿生成网页,有编辑工具精准迭代等功能,还推出可视化低代码建设工具Figma Site。

歸藏的AI工具箱