「GPT-5 Pro」共找到 2484 篇相关文章
GPT-6 Astra 发布了,我却把 GPT 的订阅从 100 刀降到 20
9 月 1 日作者将 Codex 订阅从 100 美元降至 20 美元,两天后 OpenAI 发布 GPT - 6 Astra。作者降级是因大量用 K3、Qwen 3.8 和 GLM5.3 等。Astra 功能强大,但作者仍会让国产模型担主力。
通义实验室正式开源 Mobile-Agent v3.5 及新一代多平台 GUI Agent 基座模型 GUI-Owl-1.5
通义实验室正式开源 Mobile - Agent v3.5 及新一代多平台 GUI Agent 基座模型 GUI - Owl - 1.5。该模型有多档参数可选,分 Instruct 和 Thinking 版,支持多平台。它解决了高质量数据难搞定等痛点,评测表现良好。
GPT-5系列咋都爱说「哥布林」?原因找到了
OpenAI发布博客解释模型迷上「哥布林」的原因。原来是训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。
Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团
前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。
Gemini 3 Pro的位置,Kimi K2.5也想坐坐?
Kimi 发布 K2.5,在视觉编程上表现亮眼。它通过多模态训练涌现审美,能生成美观网页。与 Gemini 3.0 对比各有优势,Kimi Code 开源终端 Agent 功能强大,Kimi 还探索 Agent Swarm 协作新路径。
MiroMind新模型超越GPT-5.4,三位顶尖AI科学家加盟
MiroMind发布MiroThinker - v1.7模型家族,在深度研究任务中表现出色,其专有智能体MiroThinker - H1超越多个顶级闭源模型。同时,三位顶尖科学家加盟,分别负责推理模型训练等方向,公司聚焦推理与可验证性。
快来看看GPT-5第一波实测
GPT-5发布引全球关注,50万粉Youtuber Matthew Berman用25分钟视频展示其近30个任务表现,如做出魔方生成器、复刻网页版Word和Excel等。它多项能力有提升,但也有不足,被马斯克质疑,还因‘52>69’名场面遭吐槽。
狂奔AGI,Claude年终封王!自主编码近5小时震惊全网
METR报告称Claude Opus 4.5能持续自主编码5小时,超OpenAI最强编程模型。AI编码智能体任务时长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。
Cursor发布Composer 2:专攻代码的模型,价格只有GPT-5的零头
Cursor本周发布自研编程模型Composer 2,只攻代码生成。其得分提升,超Claude Opus 4.6,接近GPT - 5.4 Thinking。训练基于代码数据,处理复杂编程任务准确度高,价格远低于竞品。这是Cursor全栈布局,欲掌握AI编程主动权。
GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则
新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。