速報
Opus 5 は、弱端でスマート リストを上位にし、単一のジョブコストは Fable 5 の下の 26% です
7月25日、第三者評価機関の人工分析がClaude Opus 5の成果を発表しました。 Nine のテストを組み合わせたスマート インデックスで 61 ポイントを獲得しました。, Fable 5. の 60 ポイントの狭い鉛と. GPT-5.6 ソルスコア 59 と Kimi K3 スコア 57. Opus 5のミッションあたりの平均コストは$ 2.03、Fable 5の$ 2.75未満の2.75です。 GDP val-AAA v2 と AA-Briefcase の知識作業の評価をトップアップし、Claude コードと組み合わせ、プログラミングエージェントのインデックスの最初のリストをリストします。 ターミナルベンチv2.1スコア89%、大体レベルリングGPT-5.6ソル。 5階建ての推論力を発揮します。 低から最大まで、出力トークンは8回程度で、GDP val-AAA v2は407 Eloです。 ユーザーは、より多くのパフォーマンスのためにより多くのトークンを取引することができ、コストを削減することができます。 スラブです。 Opus 5 はまだ Fable 5 の後ろに遅れています。 AA-Omniscenceテストでは、その幻覚率は1セントあたり50に上昇し、Opus 4.8よりも14パーセントのポイントが高い。 GPT-5.6シリーズよりも低推論スロットのバリューフォニー比も若干下がります。
