Anthropicは今週、Claudeによって作成されたテキストに見えない透かしが加えられることを発表しました。 外部のソースによると、このアプローチは、AI透かしのクリーンアップと呼ばれるアプリケーションやサービスの別のタイプのツールの暖かさにすぐにつながります。

記事によると、問題は増加需要だけでなく、多くの製品が誇張する機会をとっているという事実にあります。 一部のツールは、透かしを取り除くことに安定していると主張していますが、他の人は「書き換える」と「AIの痕跡をドロップする」と「認識する」と混同していますが、悪意のあるソフトウェアでも、ユーザーは自分の熱意から利益を得て、検出を回避するために使用します。

透かしは単語の選択で隠されます。

Anthropicによると、テキストの透かしは特別な文字を差し込み、身体に目に見えるマークを追加しませんが、特定のツールによって識別することができる統計モデルを形成するために、世代間の単語の選択を調整します。 テキストは正常であり、リーダーは、透かしが含まれているかどうかを直接決定することはできません。

たとえば、文が数の用語で表現されることがよくある記事です。 モデルが生成されると、特定の確率に応じて特定の種類の代替式が選択できます。 単文で異常を検知することは困難ですが、解析のためにテキスト全体をまとめて配置することでこのパターンを識別することができます。

書き直しと綴りが弱くなります。

外部のソースによると、テキスト透かしは写真の透かしと異なり、安定性は元の構造に依存しています。 ユーザーがコンテンツを書き換える限り、単語を置き換えたり、テキストを長期間スペルしたり、別のAIに再度書き換えたりすると、元の統計機能は分散することがあります。

つまり、「透かし」の多くは、必ずしもノウハウに依存しないということです。 一般的な編集、ローカル書き直し、さらには二次生成でも検出結果を減らすことができます。 そのため、一部のベンダーは、一般的な書き換え機能を「プロフェッショナルな透かし」としてパッケージ化しています。

アッシュの拡張機能

記事によると、より多くのモデルサービスプロバイダがAI出力をマークしようとすると、「透かしに行く」周りの灰色サービスは成長し続けます。 リスクの3種類があります。

  • 全てのモデルの透かしが完全に削除できるという偽の約束。
  • コンセプトの融合。 検出の円周ツールに書き換えツールを詰めます。
  • 悪意のあるプログラムの配置のためのプラグインをダウンロードまたはインストールするためのソフトウェアの使用

外部メディアの核的判断は、テキストの透かしがそれ自体が壊れていないことであり、それが周囲のマーケティングと不正が技術自体よりも迅速に広がる可能性があることです。 今のユーザーのためのより現実的な質問は「完全に排除することができます」ではありませんが、誇張された宣伝と疑わしいソフトウェアを特定する方法。