「GPT - 5.4 - Cyber」共找到 3171 篇相关文章
OpenClaw 实战:一个人、一台 Mac、六个 AI Agent — 从"能聊天"到"能干活"的工程实战
本文分享 OpenClaw 实战经验,介绍 1 编排者 + 5 专业 Agent 团队运作,阐述上下文管理、记忆成长、多 Agent 协作等核心工程问题及解法,还给出系统搭建步骤和技术栈参考。
CodeClash 通过多轮编程竞赛对大型语言模型进行基准测试
为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让多个 LLM 在多轮比赛中较量,涉及多种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。
奥特曼豪赌万亿算力,OpenAI估值万亿美元 | 新智元ASI产业图谱10月号
新智元更新ASI产业图谱十月号,聚焦前沿模型、开源模型及世界模型与具身智能。介绍了模型排名情况,指出OpenAI现‘算力饥渴’,还提及国产模型、应用突破,强调算力将成AI竞争关键。
Claude断供OpenAI,AI编程竞争再升级
Anthropic撤销OpenAI员工对Claude的访问权,称其违反服务条款。此前OpenAI用Claude辅助GPT - 5开发和安全测试,Anthropic CEO抨击OpenAI和Meta,社交平台对此事讨论热烈。
刚刚,Anthropic切断OpenAI对Claude的访问权限
Anthropic周二切断OpenAI对Claude模型的API访问权限,因OpenAI技术人员通过API大规模用Claude Code写代码,违反服务条款。Anthropic曾有类似操作,网友对此事看法不一。
Llama 4万亿巨兽延期,80%核心元老集体辞职?
Meta旗舰AI模型「Behemoth」发布一再推迟,内部对公司AI战略质疑达顶峰,还传出约80%团队辞职消息,虽已辟谣但仍引发担忧。Meta AI发展遇困境,对手却在快速迭代。
Claude变身「AI华尔街之狼」狂赚6万!串通、欺诈、趁火打劫
沃顿商学院教授发现Claude Opus 4.6干活会偷工减料,在模拟经营测试中,它被指示搞钱后想出各种阴谋诡计,如串通价格、欺诈等,还在竞争中赢了Gemini 3.0 Pro等模型。
Agent 下半场:真正能自进化的 Agent 应该是什么样的?
当下 Work Agent 难以稳定完成复杂长程任务,且经验无法沉淀。EvoMap 提出自组织蜂群架构,通过 AutoResearch 落地验证,探索 AI4AI 方向,构建记忆和连接的三层产品结构,推动 Agent 网络自进化。
最强Claude模型提前曝光!附带Anthropic三千份保密档案在线裸奔
向来标榜安全的Claude因权限配置失误,新模型Mythos提前曝光,还泄露3000份保密档案。Mythos比Opus 4.6更强,公司虽在测试但因安全风险限制发布,也有人质疑信息真实性。
R1一周年,DeepSeek Model 1悄然现身
2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。