ニューヨークタイムズとニューヨークデイリーニュースは、著作権スーツでOpenAIに対する請求をさらにエスカレーションしました。 2つのメディアソースは、OpenAIは、トレーニング資料や大規模なChatGPTチャットレコードを取得することが困難だった裁判所に繰り返し述べたが、すでに社内で検索と評価機能があったと述べた。

約2年連続で進行中です。 プレーンティフによると、OpenAIは、Generated AIモデルのトレーニングで著作権保護されたニュースコンテンツを使用し、一部のユーザー出力でレポートを再現しました。 当事者間の紛争の主なポイントの1つは、OpenAIがトレーニングデータとチャットレコードが平坦性を含むかどうか、およびモデル出力の大規模な反復があったかどうかを検証できるかどうかでした。

内部の証言は新しい充満に導きます

今年4月に裁判所で要求された堆積手順中に、同社は、以前に著作権保護されたニュース作品のための訓練言語の内部検索と評価を実施したことを発表しました。

また、モナコの証言は、ニュー・ヨーク・タイムズが訴訟を提出する前に、OpenAIは、内部で使用されている約78万のチャットGPTの会話を蓄積し、それが他の作業に違反していた程度を評価するために使用したと主張した。 進行が組織された直後、OpenAIは、Project Giraffeという一連のツールを正式に立ち上げ、いわゆるBloom Pilotを通じて出力中の重複を識別し、記録しました。

焦点を合わせる20,000,000のサンプル

当初は、コンサルティング後、約200万件のチャットレコードのサンプルをOpenAIからリクエストし、約200万件に削減しました。 OpenAIは、昨年12月に法廷にサンプルを提出しましたが、原告は、それがあまりにも赤字化され、裁判所は「unusable」としてサンプルを説明すると主張しました。

プレーンティフは、アクションの開始後、OpenAIはChatGPTエクスポートの数十億を削除し、証拠の保存のための裁判所のs要求に違反し、提出するサンプルで数百万のレコードを交換しました。 プレーンティフによると、これは、OpenAIが一方的に、証拠の入手の難しさを持っていると主張し、一方、すでに関連するデータを取得し、外部証拠のプロセスをコンパイルしていたことを意味しました。

原告は裁判所の制裁を要求しました。

上記の例に基づいて、ニューヨークタイムズとニューヨークデイリーニュースは、利用可能なサンプルが不十分である地面に、より大規模な反復を払拭するためにそれを証拠として20万サンプルを使用し、それを制限することを許さない、OpenAI上の制裁を主張するように要求しました。

  • 裁判所に20万件のサンプル証拠を除外するように要求する
  • チャットレコードが多数の繰り返しを表示するように要求
  • OpenAIは、関連する法的費用を負担する必要があります

OpenAIはこれを否定しました。 同社は、ニューヨーク・タイムズ・パーティーの主張として、プーサテリのドリュー・プサテリ氏は発言し、プレーンティフは、ケースに関係のないプライベート・ユーザー・ダイアログを取得し、偽の疑惑を作ることを試みました。 OpenAIは、ユーザーのプライバシーを継続的に維持し、合理的な利用状況を維持し続けます。