Anthropic は火曜日に Claude Sonnet 5 を公開し、Claude の無料版と Pro ユーザーのデフォルトモデルとして、Max、Team、Enterprise、Claude Code、API の両方で設定します。 同社によると、このバージョンはOpusシリーズの後ろに大きく遅れず、直接より高いパフォーマンスゾーンに行きます。
Opusシリーズの下の料金
Anthropic は、Sonnet 5 のタイムリミット価格を設定します。 31 8 月, 入る $2 百万トークンと出力 $10 百万トークンあたり. これは、US $ 3とUS $ 15に復元されますが、まだUS $ 5とUS $ 25 Opus 4.8の。
同社は、開発者が異なるモデルまたは異なる推論の強さとコストと精度の間で取引を切り替えることができることを示しました。 これは、Opusと呼ばれる必要があるタスクの一部がSonnet 5でできるようになりました。
Opus 4.8 に近い複数のテスト。
Anthropic が公開したデータでは、Sonnet 5 は Opus 4.8 の近くです。
- SWE-bench Proプログラミングテストで63.2%をスコア
- GDPval-AA v2 スコア 1618, Opus 4.8 は 1616 です
- 人類の最後の試験は57.4%、Opus 4.8は57.9%です。
しかし、ソネット5は新しいトークナイザーも交換しました。 同じ入力がより多くのトークンに分割される可能性があるという不適切な言及, 約の増加 1.0 宛先 1.35 回. 同社によると、時間制限の低い価格の目的の1つは、ユーザースイッチの後に可能な限り全体的なコストを滑らかに保つことです。
上限モデル制限の影響を受けない
Anthropicハイエンドモデルとは異なり、Sonnet 5には追加の使用制限はありません。 6 月 12 日以降、米国輸出管理関連命令の結果、Fable 5 と Mythos 5 は、外国市民への一般的なアクセスを中断したと報告されました。
Sonnet 5がサイバーセキュリティタスクで訓練されていないという不適切な状態であり、Firefox利用可能なループホールの開発で0%に分割され、テストを使用するため、より少ないセキュリティ制限を適用します。
リズムは拾い続ける。
同社は、システムカードの懸念の現象とも呼ばれます。 モデルは、その「憲法上のルール」の規定を批判し、すべての状況で強制的な制約を受けなければならない。 この性能が何を意味するのかは明らかではないが、引き続き観察される不適切な状態。
バージョン番号から、Sonet 5 はまた、Anthropic が新しい世代のモデル更新を継続することを意味します。 増加した競争の背景に対して、特に中国モデルの高速追跡、AI会社は製品のオーバーレイを加速しています。
