Agentic软件测试」共找到 4535 篇相关文章

算法论文8

RL在Agentic Reasoning中的作用:拨开迷雾,看清本质

近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
产品应用8

为何底层数据湖决定了 AI Agent 的上限?

随着 AI 落地企业进程加快,数据类型更丰富,传统企业级数据架构面临瓶颈。火山引擎构建多模态数据湖,以 Lance 为湖格式,从多维度选型技术,解决存储等问题,在多行业有应用潜力。

InfoQ
算法论文8

Anthropic:上下文工程在AI Agents的正确打开方式!

在‘提示工程’后,‘上下文工程’成焦点。它是提示工程延伸,因信息过多模型会‘失焦’,上下文是稀缺资源。文章介绍高效上下文‘解剖学’、运行时检索策略、长周期任务应对方法等。

PaperAgent
推荐文章7

AI编程到底有没有护城河?RL+Agent重塑代码世界!

作者作为cursor重度用户和算法出身玩家,分享AI编程赛道技术内幕。探讨AI编程视角下RL的难题,介绍AI编程体验进化要素,还聊了cursor 1.0更新,最后指出AI编程工具发展趋势。

探索AGI
新闻资讯8

人类最后考试已不够用,Agent最后考试来了!

AI飞速进步,人类最后考试(HLE)已不够用,伯克利牵头推出智能体最后的考试(ALE)。ALE真实、全面、可验证,当前最强AI在最难档通过率仅8.6%,主流系统平均2.6%,显示AI距替人干活尚远。

AIGC开放社区
新闻资讯7

Helidon 引入 Agent 能力,Java 框架开始内建 AI 编排

Oracle 发布 Helidon 4.4.0 版本,对齐 OpenJDK 发布节奏,纳入 Java Verified Portfolio。引入新核心能力、Helidon JSON 库,还增强与 LangChain4j 集成,支持智能体编排。

InfoQ
新闻资讯8

OpenClaw 走红背后:Agent、AI Coding 与团队协作的新问题

InfoQ《极客有约》X QCon 直播栏目邀请专家探讨 OpenClaw 爆火、使用体验等问题。指出它并非低门槛产品,AI Coding 核心问题是不稳定与不可控,还讨论了团队落地方式及未来 AI Coding 可能的拐点。

AI前线
推荐文章7

当AI吞噬软件,数据正在成为企业唯一的护城河

随AI火热,全球数据基础设施市场经历范式转移。算法与算力日趋同质,数据成企业竞争力护城河。多数企业数据体系未就绪,传统架构有障碍。文章提出AI原生数据平台的设计原则,云器科技等厂商正沿此方向发展。

InfoQ
算法论文7

用超图撕开知识边界:16万节点无师自通搞Agentic科研

传统知识图谱只能用三元组描述世界,难以应对真实科学场景里的多体交互。作者提出将文献里n元关系存成超图超边,让LLM在多智能体框架里‘沿着超边走路’,并构建了超图进行实验,实现可验证的科学发现。

PaperAgent
开源动态7

从大模型到多模态,图文混排Agent彻底起飞~

上周智谱多模态开源周,从GLM 4.6v到Autoglm,其图文并排使用场景很吸睛。上传PDF论文,它能生成图文混排解读文章,效果好。作者逆向原理复刻代码,还分享GLM 4.6V三个有意思的能力。

探索AGI