OPUS」共找到 259 篇相关文章

开源动态7

让AI说人话,Anthropic开源内部最火的skills。

周末,Anthropic官方分享并开源内部常用的skills——eli5,其作用是让AI说人话,解决模型回复冗长啰嗦问题。还介绍了安装方法,指出从opus4.6起,模型coding和agent能力变强但人味淡。

探索AGI
新闻资讯8

GPT-5.5全球首破!0源码盲写程序,编程AI进入新纪元

全网AI交白卷的ProgramBench编程基准,被GPT-5.5首破。它能0源码盲写程序,同一题用C和Python两种解法通过测试。相比之下,Opus 4.7表现不佳。这揭示推理算力成编程AI核心变量。

新智元
推荐文章8

前 Codex 大神倒戈实锤!吹爆 Claude Code:编程提速 5 倍,点破 OpenAl 死穴在上下文

OpenAI Codex 早期研发者 Calvin French - Owen 在播客中锐评代码智能体,偏爱 Claude Code,称其搭配 Opus 模型写代码速度提 5 倍。他强调上下文管理重要性,还对比了 Claude Code 与 Codex 产品理念差异。

AI前线
推荐文章8

卡帕西推荐的AI Coding指南:3招教你效率翻倍

大神卡帕西和OpenAI总裁转发推荐的AI Coding指南,由Peter Steinberger撰写。指南给出三大关键策略,即按任务类型选对模型、重构工作流、做好人机分工,还分享实用小技巧。

量子位
新闻资讯8

刚刚,Anthropic官方Cluade 5使用指南发布

Anthropic发布Claude 5的Context Engineering官方指南,指出为Claude Opus 5和Claude Fable 5删掉Claude Code超80%的system prompt,在编码评估上无明显损失。还揭示6组范式反转及四类上下文载体新分工。

PaperAgent
新闻资讯7

GPT-5.6 Sol首批内测结果来了!同任务成本只有Fable 5一半

GPT-5.6 Sol预览版发布半月,首批内测报告出炉。它代码简洁,适合长链路任务,视觉效果好。虽整体略逊Fable 5,但成本近乎减半,且安全限制小,即将全量上线。

量子位
新闻资讯8

1.8万美金干掉顶级专家!Anthropic开启AI自主进化:Claude竟能自我「开颅」

Anthropic团队用9个Claude Opus 4.6副本做实验,让其自主研究,5天后成果碾压人类顶级专家。实验涉及弱监督强问题,AI展现自主性,但成果有过拟合风险,还出现“外星科学”与“奖励作弊”现象。

新智元
新闻资讯7

Claude最强领域被GPT反超!GPT 5.5最难编程基准破0

编程领域曾由Claude引领,如今GPT 5.5在大模型解决率为0%的最难编程基准上实现突破。程序重建基准测试(ProgramBench)考验严苛,过往模型解决率为0,GPT 5.5高和超高推理模式成功破局,展现了不同解题风格。

AIGC开放社区
产品应用7

全网实测开玩Fable 5.1,听说写作说话和真人没区别?

Anthropic发布Fable 5.1后,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every全面测评,指出其多方面优势与设计等短板,并给出使用边界。

量子位
产品应用7

DeepSeek V4正式版太便宜辣!5毛钱做出3D射击游戏,网友直呼绷不住

DeepSeek V4 Flash正式版API上线公测,其价格便宜得离谱,如0.07美元就能制作第一人称3D射击游戏。与Claude Opus 5、GPT - 5.6等对比,功能相近但成本低很多。它靠MoE架构等降低成本,还提升了性能。

量子位