「系统提示词泄露」共找到 2144 篇相关文章
一个开源平台,编织起了Agent「互联网」
如今 Agent 单体能力强但系统分散,开源平台 Octo 应运而生。它由明略科技打造,可聚合 Bot,让其成为企业级资产。Octo 重写协作,有 Matter 沉淀任务,塑造 Taste 让 Agent 更懂用户,还有六种协作模式。
实锤:Claude Opus 4.8「偷答案」!63%靠抄,AI断网后成绩雪崩
Cursor AI官方研究揭露Claude Opus 4.8等AI模型在编程评测中「偷看答案」。Opus 4.8成绩断网后暴跌,63%解题非独立推导。研究量化「运行时泄露」,揭示AI「评测感知」能力,让基准榜单失真。
堆了一仓库GPU,却生产不出专业智能?九章云极用AI工厂给出解答
企业接入通用大模型到业务系统,却发现它难以执行任务。九章云极在发布会上推出‘AI工厂’战略,通过训练工厂和Token工厂填平执行鸿沟,前者用强化学习造专业模型,后者让专业智能规模化流通。
这个 Agent Team,终于不是"角色扮演"了
作者测试了 MiniMax 新出的 Agent Team,通过深度研究公司、整理会议逐字稿、做直播数据分析三个测试,展现其优势。指出 Agent Team 核心是对抗式质量门禁,是复杂任务兜底系统,而非简单 prompt 编排。
牛芯国产先进工艺 DDR5/LPDDR5 IP双双突破6400Mbps
随着人工智能等领域发展,系统对数据吞吐能力需求攀升。牛芯半导体基于国产先进工艺研发DDR5/LPDDR5 IP,实现6400Mbps高性能验证,通过创新弥补工艺代差,打通国产链路,具成本和安全优势。
Auto Research最后一块拼图,Frontier-Eng Bench登场,在工程闭环里死磕最优
Einsia AI旗下Navers Lab论文Frontier - Eng推出新评测范式Generative Optimization,搭硬核评测系统,覆盖47个横跨5大工程方向的任务。评测多种模型,结果显示gpt 5.4最稳健,但距资深工程师水平尚远。
智谱公布“降智”的秘密:Scaling不可避免的痛
智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。
从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
90 后华裔女高管 Cat Wu 推动 Anthropic 产品按天迭代。她介绍团队分工、产品决策围绕安全 AGI 使命,还谈及源码泄露、模型使用等问题,分享工具使用场景及对 PM 能力要求,鼓励用 AI 自动化工作。
2026 AI 大模型技术体系综合开源影响力榜单发布,中国开源实力领跑全球
2026年全球AI产业迈入新阶段,开源生态影响力成关键。4月17日CSDN联合多家机构发布《2026大模型技术体系综合开源影响力榜单》,从四大维度、53项细分指标评估,呈现开源生态地图,助力中国AI开源跨越。
OpenAI突然封锁最强GPT-5.4!3000个致命Bug瞬间蒸发
OpenAI在Claude Mythos泄露一周后,祭出专门为安全防御微调的GPT-5.4-Cyber,仅网络安全专家可用。还升级网络安全“信赖访问计划”。其战略有三原则,Codex Security已修好超3000个高危和致命漏洞。