「产品测试」共找到 3214 篇相关文章
看似无害的提问,也能偷走RAG系统的记忆——IKEA:隐蔽高效的数据提取攻击新范式
研究聚焦RAG系统,提出全新黑盒攻击方法IKEA。它不依赖异常指令,通过自然查询提取私有信息。经多数据集测试,其效率和成功率高,还证实提取知识实用,揭示RAG系统潜在脆弱性。
Agentic 软件工程:造 Agent 只是最简单的部分
Agno 创始人 Ashpreet Bedi 认为造 Agent 简单,让其在生产环境稳定运行才是挑战。他提出 Agentic 软件六大支柱,给出 AgentOS Docker 模板代码实践,指出多数 Agent 产品卡壳是基础设施跟不上。
Cursor 的困境:它真的找到 PMF 了吗?
知名投资人 Chris Paik 探讨 Cursor 困境,指出其依赖的‘无限使用’订阅模式易致成本与收入失衡。分析了商业模式与产品匹配的重要性,认为补贴非商业模式,Cursor 需明确用户需求本质。
中科院开源PPT Agent,一键自动生成PPT智能体
中科院软件所等联合开源PPT Agent,它能分析参考幻灯片,按人类流程分两阶段生成PPT,有自我修正功能,测试显示在多维度优于现有方法,极大节省用户时间精力。
吴恩达来信:认识新一代生成式AI应用工程师
吴恩达介绍新一代生成式AI应用工程师,指出其需具备利用AI构建模块开发应用、借助AI辅助编程能力,有产品能力是加分项,还分享面试考察内容与问题。
Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro
Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。
通义实验室最新成果WebDancer:开启自主智能Deep Research的新时代
通义实验室推出 WebDancer,解决自主信息检索智能体构建难题。它创新合成训练数据,采用两阶段训练策略应对开放网络训练挑战,在多个基准测试中表现卓越,未来还将拓展能力。
仅用10天?Anthropic最新智能体Cowork的代码竟然都是Claude写的
Anthropic发布智能体工具Cowork,仅耗时一周半,其代码由Claude Code所写。它是Claude Code简化版,向特定用户开放,有多种功能。有用户称效率提升巨大,也引发创业圈震动,部分类似产品开源。
刚刚,Anthropic切开Claude大脑!AI自发长出类人「意识器官」
Anthropic开源「手术刀」J-Lens,读出Claude未说出口的念头。研究发现Claude自发长出类似人脑「意识」结构J-space,通过多项测试与全局工作空间理论对标,还表现出类似人脑的现象。
Sora 关停背后:为啥它没跑成“视频版 ChatGPT”?
OpenAI Sora 宣布关停,其评论区评价两极分化。它没跑成“视频版 ChatGPT”,问题在于使用频率、成本结构和产品形态。关停或与 OpenAI 筹备 IPO 有关,未来 Sora 团队将推进相关研究。