「GPT-5.4 Pro」共找到 3316 篇相关文章
字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA
5月13日,火山引擎在上海发布5款模型和产品,其中豆包1.5・视觉深度思考模型(Seed1.5-VL)最吸睛。它激活参数20B,性能与Gemini2.5 Pro相当,38个评测基准达SOTA,推理成本低,已开放API。
Auto Research最后一块拼图,Frontier-Eng Bench登场,在工程闭环里死磕最优
Einsia AI旗下Navers Lab论文Frontier - Eng推出新评测范式Generative Optimization,搭硬核评测系统,覆盖47个横跨5大工程方向的任务。评测多种模型,结果显示gpt 5.4最稳健,但距资深工程师水平尚远。
刚刚,Claude Fable 5续命5天!省钱攻略来了
7月7日凌晨,Anthropic官宣最强Claude Fable 5限时免费延长到7月12日。开发者给出自救方法,Anthropic也甩出顾问和编排者两套省钱架构,实现成本降低效果。
谷歌IMO金牌级Gemini 3深夜上线!华人大神挂帅,OpenAI无力反击
谷歌DeepMind推出IMO最强金牌模型Gemini 3 Deep Think,以2.5倍暴力性能碾压GPT - 5.1。它在多项基准测试表现出色,已在Gemini App上线。谷歌还将在新加坡组精英团队,由华人科学家Yi Tay率队。此外,Gemini 3 Pro使网页端市占率创新高。
刚刚,Opus 5来了:性能不输 Fable 5、价格砍半
Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测中表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度高,防护兼顾安全与可用。
Agent大革命!Claude 4连续自动编程7小时,刷新世界记录
今天凌晨Anthropic召开开发者大会,发布Claude 4,含Opus 4和Sonnet 4。Opus 4编程智能体连续工作7小时破纪录,Sonnet 4在SWE - bench表现超前沿模型。还新增功能,Claude Code开放,API也有新特性,Sonnet 4免费但有限制。
牛芯国产先进工艺 DDR5/LPDDR5 IP双双突破6400Mbps
随着人工智能等领域发展,系统对数据吞吐能力需求攀升。牛芯半导体基于国产先进工艺研发DDR5/LPDDR5 IP,实现6400Mbps高性能验证,通过创新弥补工艺代差,打通国产链路,具成本和安全优势。
Seedream 4.0大战Nano Banana、GPT-4o?EdiVal-Agent 终结图像编辑评测
在AIGC下一阶段,图像编辑成检验多模态模型关键场景。研究者提出EdiVal - Agent评估框架,能自动化生成指令并多维度评估编辑结果,其评估与人类判断一致性高,还对比了13个模型的多轮编辑表现。
1899个MCP服务安全研究:7.2%存在漏洞,5.5%暗藏「工具投毒」
研究人员对1899个开源MCP服务器扫描,发现7.2%项目有漏洞、5.5%遭工具投毒。MCP虽成事实标准且发展好,但代码质量堪忧,传统安全工具难检测其风险,为生态敲响警钟。
AI编程新王Claude 4,深夜震撼登基!连续编码7小时,开发者惊掉下巴
Anthropic发布全球最强编程模型Claude 4,含Opus 4和Sonnet 4。Opus 4是顶尖编码模型,Sonnet 4是Sonnet 3.7的重大升级。还发布系列产品,Claude 4定价与此前一致,部分用户可体验。