速報
人類はモーダーに自分自身を露出しました 2: ミトスよりも強い 5, 中断
Anthropicの最新のリスクレポートは、内部モデルであるモデル2がMythos 5よりも全体的なパフォーマンスを大きくし、多くの内部タスクで大幅に強化されました。 現在、コード作成、データ生成、およびアンジェントの実行には、モデルが広く使われていますが、アンソロピーは公開計画はありません。 また、昨今のサイバーセキュリティテストや事故により、高リスク設定におけるモデルのリスク判断が「非常に低い」から「低い」へと移行し、以前よりも少ない一定のリスクを判断したと報告しています。 また、社内モデルのコードネーム「モデル2」が多くのミッションでよく行われ、外部で見られるアンソロピーの最高のモデルは、実際のフロントラインモデルの背後にある可能性があると言及しています。
