「自动化评估工具」共找到 2878 篇相关文章
超越千问和TRAE Work:这款还没“满月”的AI办公产品,凭何越过混战?
AIGCRank 8月AI办公智能体榜单出现新面孔库库AI,上线不到一个月跻身前列。文中对比它和豆包工作、WorkBuddy、千问办公的功能,指出无最好的工具,需按需选择。
Specula在67个开源系统中找到382个深层bug,数月形式化验证缩短到几小时
截至2026年8月19日,Specula已在67个开源系统找出382个bug。它让coding agent自动生成TLA + 模型和正确性不变量,运行检查并复现问题,将数月的形式化验证缩短到几小时,降低了形式化方法使用门槛。
Claude 上线隐形水印
从上周起,Anthropic 在 Claude 模型所有文本输出中嵌入隐形水印。该水印在文本生成时织入文字,复制粘贴也保留,编辑修改可能仍在。标记机制分文本水印和文件元数据两层,全球生效。
OpenAI开源Privacy Filter:PII检测不用传服务器 Apache2.0可商用
OpenAI开源Privacy Filter模型,采用Apache2.0协议可免费商用。它是PII检测工具,支持全本地运行,避免数据泄露。有诸多技术亮点,也有一定局限性,上线后下载量可观。
告别人工干预!KDD Cup 2026 Data Agents 赛道:定义下一代数据智能体能力边界
KDD Cup 2026 发布 Data Agents for Complex Data Analysis 赛道,由香港科技大学(广州)和清华大学联合承办。旨在推动 AI 告别人工干预,具备自主任务分解等能力,还推出 DataAgent - Bench 测试平台,有丰厚奖励,公布关键时间节点。
从它石智航的世界纪录里,我看到了具身大模型落地干活的希望
在上海AWE展会,它石智航的A1机器人获“机器人在一小时内装配亚毫米级线束最多次数”吉尼斯世界纪录。这得益于它石自研通用具身大模型「AWE3.0」,该模型实现多项突破,推动具身智能落地。
当具身智能遇到“大脑”瓶颈,一家国家队公司决定拆掉围墙共筑基石|甲子光年
2月28日“启智涌现”开发者大会举行,启智机器人试图解决行业软硬件耦合深等矛盾。它打造通用技术底座,用大衍数据平台等构建技能进化引擎,还以新商业模式构建生态飞轮,推动机器人融入各行业。
18.5K star!一键将电子书转为有声读物,支持1k+语言!
开源君分享开源工具`ebook2audiobook`,能将20多种格式电子书一键转为有声读物,支持超1100种语言,有语音克隆等功能,在Github获18.5K star,安装使用简单。
Anthropic工程师都离不开!深夜随手撸出的开源神器,被OpenAl高价收购,23人创业逆袭
昨日 OpenAI 宣布收购 Promptfoo 保障 AI 智能体安全,技术将整合进 OpenAI Frontier。该工具由 Discord 工程师开发,受诸多企业和开发者欢迎。收购后它将保持开源,继续支持现有客户。
不用花Anthropic API的钱,本地跑Qwen3.5就能用Claude Code
文章介绍不花Anthropic API的钱,用本地Qwen3.5跑Claude Code的方法。包括选模型、编译安装llama.cpp、下载量化模型、启动本地服务、配置Claude Code指向本地服务等步骤,还提及踩坑建议和使用方法。