Agentic软件测试」共找到 4555 篇相关文章

算法论文8

DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍

近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。

量子位
新闻资讯7

Karpathy投了一家AI记忆公司,撞名DeepSeek Engram记忆架构

新公司Engram完成9800万美元融资,投资人有Andrej Karpathy等。它想为AI构建能持续学习的“记忆层”,解决模型吸收组织内部知识问题,首个产品是面向Agent的API,已与多家合作。

机器之心
开源动态7

Claude Cowork刚发布,就有大佬开源复刻了!支持三方 API,让 AI 帮你干活!

2025年AI关键词是Agent。Claude推出新功能Cowork,定位是‘大众版Claude Code’,但官方版贵且封闭。发布不到24小时,GitHub就有大佬开源复刻版Claude - Cowork,它支持三方API,本文深度剖析其功能与特点。

开源星探
开源动态8

Mini-SGLang,30万行代码浓缩为5000行,大模型推理高性能教学与研究模版

SGLang发布Mini-SGLang,将30万行代码缩至5000行,保留核心特性,为大模型推理提供高性能教学与研究模版,解决教育门槛高和科研原型开发难的痛点,还经测试验证了性能。

AIGC开放社区
开源动态8

ROCK & ROLL!阿里给智能体造了个实战演练场 | 开源

阿里开源新项目ROCK,解决了智能体无法在真实环境中规模化训练的难题。它与阿里此前的RL训练框架ROLL配合,构成完整的智能体训练闭环,推开了Agentic AI规模化应用的大门。

量子位
开源动态8

微软开源2025 ICML获奖框架,终结大模型多轮对话严重缺陷

微软开源2025年ICML获奖框架CoLLabLLM,可解决大模型多轮对话缺陷。它由四大模块构成,经多轮对话模拟和奖励优化模型。在三大基准平台测试显示,能在多样任务中高效协作。

AIGC开放社区
新闻资讯7

我在OpenAI修中文

OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。

机器之心
开源动态7

LLM 的记忆问题「很快」就不再是问题了?

当前智能体范式转变,AI Memory 成核心基石,分化为「Agent Memory」与「LLM Memory」。开源项目 OpenClaw 引发热议,其「长效记忆」让 AI 记忆问题形成边界,不过 LLM Memory 仍面临挑战。

机器之心
产品应用8

刚刚,Anthropic分享了构建Skills的最佳实践

Anthropic获300亿美元融资,估值达3800亿美元,发布《The Complete Guide to Building Skills for Claude》指南。介绍Claude Skills本质、与MCP关系、应用场景、技术实现、设计模式及测试迭代方法。

PaperAgent
新闻资讯7

LeCun离职后不止创一份业!押注与大模型不同的路线,加入硅谷初创董事会

离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流大模型路线不同,其Kona模型在数独测试上表现远超大模型。

量子位