「AI分析系统」共找到 10633 篇相关文章
AI下半场的战场,从Agent记忆体正式打响
OpenClaw开源项目爆火,标志AI进入下半场走向真实应用。关键在于解决AI在现实中持续干活的问题,核心是Agent Memory。论文梳理该赛道,指出其是系统级记忆体结构框架,未来关键在memory策略可学习。
0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。
全球首个历史基准!普林复旦打造AI历史助手,AI破圈人文学科
普林斯顿大学AI实验室与复旦大学历史学系联手推出全球首个历史领域评测基准HistBench及AI助手HistAgent。HistBench含414道题,能检验AI深度认知能力;HistAgent集成多种工具,在测试中表现优异。
AI原生数据库的思考
文章围绕AI原生数据库展开,分析企业应用大模型的问题,指出AI场景驱动数据库新工作负载。探讨AI数据库变与不变、实现路径,介绍原生混合搜索、现代数据架构、数模融合等,还提及seekdb的发布、定位、优势与不足。
小扎秘密研发CEO Agent!开源「人生托管系统」爆火
《华尔街日报》披露,扎克伯格正开发“CEO Agent”,绕过汇报链获取信息。同时,一AI博士生因生活管理难,开源含8个Agent的“人生托管系统”,引发讨论并指出隐患。
一篇95页最新80种Deep Research系统全面综述
浙大研究深度研究系统领域,分析自2023年以来80多个实现,提出4维度分层分类法,全面分析4种实现架构,涵盖基础模型、工具利用、任务规划、知识综合等方面的演变与进步。
AI 时代,编程语言选型更难也更重要:Go、Rust、Python、TypeScript 谁该上场?
AI 写码成常态,编程语言选择更重要。创业者 Armin Ronacher 指出语言权衡需重审,会影响 Agent 代码质量。他认为 Go 在 AI 场景合适,公司绕不开 Python 和 JavaScript。还分析多种语言特点、适用场景及 AI 对编程的影响。
Qoder CLI + Harness Engineering 实战:构建 7×24h 无人值守用户反馈自动处理系统
在 Qoder 产品用户反馈增多、人力处理流程痛点凸显的背景下,构建 7×24 小时无人值守的用户反馈自动处理系统。该系统分四个核心模块,基于 Qoder CLI 实现,显著提升处理效率。
谷歌发布最强 AI“全家桶”、一句话就让AI拍大片!这一夜,谷歌Gemini贯穿始终,网友:果然Android“靠边站”了
谷歌在I/O大会推出AI“全家桶”,含Gemini 2.5模型更新、搜索新AI模式等。谷歌已发布十多个新模型、20多个重大AI产品与功能,多项数据显示AI发展迅速,还有多项目融入产品,多模态模型升级。
大模型系统提示词逆向(1)—— ChatGPT
文章介绍大模型系统提示词逆向原理,利用‘认知冲突’让AI意外‘泄密’。还给出逆向提示词示例,并展示了ChatGPT系统提示词原文及翻译,包含其角色设定、工具使用规则等内容。