「智能测试用例生成系统」共找到 4791 篇相关文章
刚刚,OpenAI通用智能体ChatGPT Agent正式登场
北京时间周五凌晨,OpenAI发布全新ChatGPT Agent,实现通用智能体能力关键升级。它能自动用多种工具规划,完成复杂任务,已向部分订阅用户开放。其整合多能力,配备工具,基准测试表现佳,但也有安全风险。
谷歌发76页智能体白皮书!你的「AI替身」已上线
谷歌发布76页AI智能体白皮书,剖析其应用前景。涵盖智能体运维、评估方法,探讨多智能体架构,还介绍智能体增强检索生成及企业应用,如NotebookLM企业版、Agentspace空间企业版等。
多智能体大语言模型中的人类自适应协作
尽管大语言模型有进展,但纯自治多智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 在基准测试中表现出色,为构建 Agentic 系统提供指导。
首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈
厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。
腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent
智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。
SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能体,更少计算,更强性能
在多模态大模型加持下,纯视觉GUI智能体成通用操作智能体重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。
满分的「差」,Qwen与复旦等揭示编程智能体奖励设计的结构性困境
Qwen团队与复旦等联合发表论文《The Verification Horizon: No Silver Bullet for Coding Agent Rewards》,指出编码智能体奖励设计存在结构性困境,任何奖励信号只是人类意图的‘替身’,验证需成系统与智能体协同演化,并研究多种验证者。
将科研脏活累活真·丢给AI!上海AI Lab推出深度科研智能体FlowSearch
上海人工智能实验室推出深度科研智能体FlowSearch,它由动态结构化知识流驱动,有三大核心模块。在多个科研基准上性能领先,能让科研更高效,标志科研智能体迈向新阶段,还为未来系统奠定基础。
通义实验室最新成果WebDancer:开启自主智能Deep Research的新时代
通义实验室推出 WebDancer,解决自主信息检索智能体构建难题。它创新合成训练数据,采用两阶段训练策略应对开放网络训练挑战,在多个基准测试中表现卓越,未来还将拓展能力。
全面拥抱AI Agent,从0到1动手用GPTBots搭建企业数字助理智能体,办公效率翻倍~
文章指出当下Agent/Agentic AI是热门风口,企业级智能体受资本追捧。重点分享运用GPTBots平台从0到1搭建企业数字助理智能体,涵盖架构、流程、设计、测试等内容,介绍选择该平台的原因及实践成功关键。