ChatGPT は EU のテキストに目に見えない透かしを導入しますが、削除するのは難しくありません

AI によって生成されたコンテンツが豊富に存在するため、テクノロジー企業は、 合成元を特定する目に見えない透かしを画像やビデオに挿入しますが、テキストでこれを行うのはより大きな技術的課題です。 AI によって生成されたテキストを検出すると主張するさまざまなツールが市場に出回っていますが、実際のところ、その結果は通常は信頼できません。 現在、ChatGPT によって生成されたテキストに透かしを導入し始めているのは OpenAI ですが、これは欧州連合内のみに限られます。。

そうなる理由は、 AI法 欧州連合では、生成 AI モデルのプロバイダーに次のことを義務付けています。 機械可読システムを通じて人工知能によって生成されたコンテンツを識別できるようにする。本日より、OpenAI API の顧客は特定のモデルに対してウォーターマークを有効化できるようになり、今後数週間にわたって、 同社は、EU 内で ChatGPT と Codex によって生成されたテキストに目に見えない透かしを自動的に追加し始める予定です。。

textGrain の仕組み

ChatGPT ウォーターマークは、隠し文字、異常な句読点、非表示のスペース、または追加のトークンをテキストに追加しません。その代わり、 OpenAI の textGrain 技術は、モデルによって選択された単語とトークンの統計パターンを微妙に変更します。。

AI がテキストを生成するとき、次に出現する可能性のあるトークンにさまざまな確率を割り当てます。これらはテキストを分割するための小さな単位であり、単語、その一部、または句読点に対応します。 TextGrain は、秘密のパターンでこれらの確率をわずかに変更します。 モデルに特定の選択肢を選択するよう促します。先進的なものと同様のアイデアです 人間的 のために クロード 8月に。

OpenAI は、その textGrain 技術が、テストした他の方法の結果と同等、またはそれを超えていると主張しています。 シンセID テキスト用 グーグル。同社はまた、この技術を研究者やその他の組織が利用できるようにして、人工知能によって生成されたテキストを検出するツールを開発できるようにする予定です。

OpenAI が AI 検出をだます方法をテキストで説明

ただし、OpenAI 自体はテキスト内の透かしを認識します。 画像や音声で使用されるものよりも信頼性がはるかに低くなります。。テキストが短いほど、それが AI によって生成されたかどうかを判断するのが難しくなります。

同社の内部テストによると、同社の検出器は周囲を識別できました。 80% 透かし入りの断片の トークン200個 そしておよそ 95% の断片の 400トークン。

ただし、小さな変更でもウォーターマークを大幅に弱める可能性があります。 OpenAIが実施したテストでは、 単語の 10% だけを別の単語に置き換えると、検出率は約 92% から 66% に減少しました。単語の 25% を置き換えることで、その割合はわずか 17% に低下しました。。

誤検知による不当な告発を防ぐために、OpenAI は次のように警告しています。 透かしの検出は、誰かが ChatGPT を使用してテキストを作成したという証拠とみなされるべきではありません。フラグは、OpenAI モデルがコンテンツの一部を生成または処理したことを示す場合がありますが、 ユーザーがその後どの程度変更したか、または最終結果のどの部分が人間の作業に相当するかを判断することはできません。。