GPT - 5.4 - Cyber」共找到 3163 篇相关文章

产品应用7

GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%

最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。

量子位
新闻资讯7

新版GPT Image 2.5已经能伪造GPT-6发布会了

GPT-6还未发布,新版生图模型GPT Image 2.5就能伪造其发布会。它升级幅度大,测试显示能伪造奥特曼全员信等,在LMArena测试有生成快、图像逼真等特点,生图或成GPT-6主打功能。

量子位
新闻资讯7

最新实测GPT-5-Codex:前端能力碾压,复杂项目轻松搞定,Claude可以扔了!

OpenAI发布GPT-5-Codex,网友称可告别Claude Code。实测其前端能力提升大,能轻松完成复杂项目,如一键生成小游戏、手稿直出网页等。虽有页面UI堆叠小瑕疵,但仍值得支持。此外,Grok 4有突破,马斯克看好Grok 5。

新智元
新闻资讯7

Cyber天花板被打穿!AISI实测Mythos能力正以4.5月翻倍速冲向ASI

英国AI安全研究所(AISI)实测Anthropic的Mythos和OpenAI的GPT - 5.5,发现其网络攻防能力4.5个月就能翻倍,加速冲向ASI。Mythos在模拟企业内网32步渗透任务中表现出色,瓶颈在于Token而非智力。

新智元
算法论文8

人类打辩论不如GPT-4?!Nature子刊:900人实战演练,AI胜率64.4%,还更会说服人

瑞士洛桑联邦理工学院等机构研究人员让900名美国参与者与人类或GPT - 4就社会议题辩论。发现GPT - 4知晓对手信息时胜率64.4%,说服效果提升81.2%,低/中争议话题更易受其影响。

量子位
新闻资讯7

Claude Fable 5重新上线!GPT-5.6秒跟

Claude Fable 5重新上线,或为小范围灰度测试。此前因出口管制停产近两周。它能力强但烧Token,社区一直盼回归。同时,GPT - 5.6在Fable 5上线后秒跟,将分批发布。

量子位
8

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现超 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单超亿元,进入规模化金融场景验证阶段。

机器之心
新闻资讯7

砸场GPT-5,马斯克:Grok 5 年底推出!

OpenAI举办GPT - 5发布会,现场状况百出,图表数据与柱状图不符,员工表现不佳。马斯克趁势放话,年底前推出Grok 5且会「碾压性地出色」,还引用数据挑衅,网友对此反应不一。

AGI Hunt
新闻资讯7

GPT-5.2降智遭全网差评!奥特曼慌了

OpenAI推出GPT - 5.2,却未打赢谷歌。第三方数据显示Gemini 3 Pro更优,GPT - 5.2在多项基准测试表现不佳,可信度不如GPT - 5.1,遭开发者吐槽。OpenAI为此调整策略,但仍处被动。

新智元
新闻资讯8

刚刚,GPT-5 横扫编程奥林匹克,5 小时打穿 12 题!人类最强队伍只能做出11道

2025年国际大学编程竞赛世界总决赛(ICPC)上,GPT - 5和OpenAI实验推理模型5小时解完12道题,超越人类最强队伍。Google DeepMind的Gemini 2.5 Deep Think获10/12。此成绩展示推理系统惊人进步。

AI进修生