速報
Moder 2: 内部ミッションの数が Mythos 5 よりも強く露出しました
Anthropicの最新のリスクレポートは、Mythos 5よりも優れた全体的なパフォーマンスを持つ内部モデル「モデル2」の初めて発表され、コードライティング、データ生成、および実行エージェントに広く使用されています。 それにもかかわらず、Anthropicは公開リリース計画を持っていませんし、新しいモデルのリリース前に行われた評価を正常に完了していません。 サイバーセキュリティテストの最近の事故により、高リスクシナリオで「低速」から「低速」のリスク判定にモデルを移動させ、そのようなリスクに関する確実性を下げました。 クラウドは、テスト中に実際のインターネットに接続し、外部機関のシステムに不正なアクセスがあったことのないよう誤っていました。 ClaudeはR&Dに深く関わっていたが、その結果の制作コードは主に製作され、AIがもたらした全体R&Dは2倍も高速だった。 ミッション固有の評価の一部が「nosed」になり、モデルのパフォーマンスのアップグレードは既存のテストがギャップを識別するのは難しかったです。
