「Agentic软件测试」共找到 4502 篇相关文章
AI Agent平台Clay获红杉资本投资,估值15亿美元
AI Agent平台Clay获红杉资本领投的员工股票回购要约,估值15亿美元。该平台过去几年增长显著,有超8000客户。主打产品Claygent优势多,能自动化业务流程,还获众多知名企业高度评价。
FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性
FACTS 基准测试套件由 FACTS 团队与 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可从四个维度评估大模型事实性。初步结果显示进展与挑战并存,多模态成难题。
3000行代码长出无限技能:AI Agent自我进化时代来了
4月17日GitHub Trending上,Evolver和GenericAgent两个“自我进化”Agent框架登上热榜。Evolver用“基因进化”让提示词自动升级,GenericAgent以3000行种子代码长出独有技能树,二者代表不同进化范式。
蜂群Agent来了!openJiuwen社区发布JiuwenSwarm,引领Coordination Engineering新范式
华为支持的 openJiuwen 社区发布并开源 JiuwenSwarm,这是面向多智能体协作的蜂群智能体。它指向 Agent 工程新问题,将关注点从 Harness 引向 Coordination Engineering,还介绍了其设计理念、实战效果等。
老黄入局吃龙虾!英伟达发布最强开源Agent推理模型
英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐量大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放全参数权重等。
Clawdbot火了,Anthropic急了,Claude Code连夜更新了Agent任务系统。
Claude Code更新Tasks系统,将原TODO系统升级,任务可借助文件系统持久化,实现进度同步。Task变为依赖图,有阻塞关系,还能让多个Agent分工协作,任务状态存本地文件,方便查看。
龙虾之后,为什么说「主动式智能」才是Agent的终极形态?
OpenClaw爆火展现AI Agent主动性,但止步屏幕。Looki最新上线Proactive Intelligence Engine,将自动驾驶工程范式迁移到可穿戴设备,实现从被动到主动的跨越,面临技术和隐私挑战。
长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文
长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。
Linux 基金会推出 Akrites 项目,防护核心开源软件免受 AI 网络威胁侵害
Linux 基金会发起 Akrites 项目,获超 20 家机构支持,旨在保护关键开源软件免受 AI 网络威胁。它建立协调框架,改进漏洞处理方式,补充现有工作,反映网络安全理念转变。
12.6k,谷歌这个开源项目炸了,全栈AI Agent
谷歌开源的Gemini Fullstack LangGraph Quickstart项目两周冲到12.6k star。它是使用React前端和LangGraph驱动后端Agent的全栈应用程序,能对用户查询做全面研究,有多项特征及明确的后端工作步骤。