Anthropicは、Claudeテキストの透かしがどのように機能するかをさらに開示します。 このアレンジは、AI法に基づく透明性に関するEU行動規範に則り、AI企業がAI生成されたコンテンツを識別するためのメカニズムを確立する必要があります。

単語選択に埋め込まれた透かし

同社は、Claudeが低リスクオプションの一部に特定のモデルを埋め込む最新のブログで説明しました。 天気を記述するときは、例えば、同様の意味を持つ複数の単語の間で選択します。 このようなモデルは、通常の読者が検出するのは困難ですが、対応するキーを保持するパーティーによって検出することができます。

Anthropicはテキストの透かしがClaudeの出力品質に影響を及ぼさないことを示します。 読者にとって、透かしと透かしのない応答の重要な違いはありません。

SynthID-Text はテストに使用されます。

Claudeは、2024年に導入されたGoogle DeepMind ' s Syndrid-Textプログラムを使用しており、透かしテストAPIを導入する予定です。 同時に、Anthropicは、これは、いくつかのAIテスト企業が習慣や文章の特徴を分析することによってAIを使用するかどうかを判断する方法とは異なることを強調しています。

前者は、あらかじめ埋め込まれたマークを確認することですが、後者はテキストスタイルから推論されます。 両方のアプローチの合理性は同じではありません。

コードシーンの透かしは弱くなります。

「書き換え後に識別できるかどうか」というユーザーの懸念に関しては、わずかな編集率が完全に透かしを除去できない Anthropic argues、しかしテキストが完全に書き換えられ、ほとんどすべての単語が置換された場合、透かしは消える可能性があります。

また、テキストの長さや変更の程度に応じて、透かしが検出される可能性があるかどうかについても言及しました。テキストは、Claudeの校正や小さな収益によってのみ作成されました。 変更が軽かった場合、コンテンツの大半はまだ人間の作者によって行われ、非常に少ない水スタンプがあります。

ウォーターマークは、コード生成されたシナリオで通常のテキストよりも激しいものではないと予想されます。 この理由は、モデルが実行オフコードの出力と自由置換式のスペースの少ない量を必要とすることです。 しかし、コードノートなどの位置では、透かしが利用でき、実際のコードには少し効果があります。

追加情報:Anthropic は、Claude がテキストの透かしを使用する唯一のチャットロボットではないことを示します。また、透明性のための同じ行動規範に署名する他の大規模なモデル開発者は、そのプログラムを展開します。