Anthropicは、対話のパフォーマンスを高めるだけでなく、エージェントの能力を移動させることに焦点を合わせている中規模のモデル、Claude Sonnet 5の新しい世代をリリースしました。 OpenAIとGoogleは、近年、製品を強化し続けています。モデルコンペは、コスト、安定性、マニュアルの介入の少ない実装能力にシフトしています。

デフォルトモデルとして7月から

Anthropic は、火曜日のように、Claude Sonnet 5 は、無料で Pro 版のデフォルトモデルになり、すべてのサブスクリプションレベルに開きます。 高レベルモデル、Opus 4.8 の近くで製品として配置しましたが、低コストです。

出版物の時点では、Sonnet 5の価格は1億ドルの入力トークンと8月31日までの1億ドルの出力でした。 その後、入力価格は1億ドルに増加し、出力価格は変更されません。

  • 8月31日 事前登録: $2/million トークンを入力してください
  • 9月: $3/million トークン
  • 出力価格: $10/million トークン

価格比較では、Sonnet 5 は Anthropic 独自の Opus 4.8 よりも低く、OpenAI の GPT-5.5 と Google の Gemini 3.1 Pro よりも低いが、Gemini 3.5 フラッシュよりも高い。

エージェント ミッション パフォーマンス アップグレード

ソネット5は、この年2月にリリースされたソネット4.6と比較して、推論、ツールコール、ソフトウェアプログラミング、知識ベースのタスクの面でアップグレードされたという驚くべき主張。 同社が与えられたベースラインテストは、モデルがOpus 4.8の1セント69.2に近く、ソンネット4.6の58.1以上であったエージェントプログラミングプロジェクトに63.2パーセントをスコアしたことを示しました。

知識試験では、ソネット5はオパス4.8よりも若干高かった。 後者は、複雑な判断や詳細な研究などの困難なタスクに対処するために、以前より使用されていました。

Anthropic によると、これは開発者がコストとパフォーマンスの間のより良いトレードオフを作ることができることを意味します。 Sonet 5は、最高の精度を必要としないシナリオのためのより安いオプションになりますが、マルチステップのタスクを安定させたいです。

セキュリティの強化

パフォーマンスに加えて、Anthropicはセキュリティ性能にも注力しています。 同社は、Sonnet 5は、不正な援助、欺瞞、悪意のある要求の攻撃と拒否に対する応答の領域における前世代のsモデルよりも優れていると主張しています。 また、幻覚および結束応答の発生率が減少しました。

しかし、AnthropicはSonnet 5はまだOpus 4.8とClaude Mythos Previewのレベルに達していないと述べた。 同時に、モデルは、現在のOpusシリーズよりも危険なネットワークセキュリティタスクを遂行する可能性が著しく低くなります。そのため、エージェントのシナリオで大規模な展開に適しています。

一部のテストユーザーも肯定的なフィードバックを与えました。 Zapier エンジニアは、Sonnet 5 は、以前は簡単に停止していたマルチステップの自動化ミッションを完了することができたと述べた。別の AI 製品会社、可愛、モデルは、安全でない要求を再利用してより安定していたと述べた。