MENU

OpenAIがテキストの電子透かし技術を公開、EU規制へ対応

AI開発のOpenAI社が、AIによって生成されたテキストに不可視の識別信号を埋め込む「テキストウォーターマーキング」へのアプローチを公開しました。これは、欧州連合(EU)のAI法(EU AI Act)に基づいた対応の一環です。

まずは何が起きたのかを簡単にまとめます。OpenAI社は、新技術「textGrain」を用いて、AI生成テキストを機械的に識別可能にする仕組みを導入し始めたと発表しました。具体的には、世界中のAPIユーザー向けにオプトイン方式(利用者が希望した場合に有効にする形式)で提供を開始し、今後数週間以内にEU域内のChatGPTおよびCodexの対象ユーザーへ展開する計画です。

目次

なぜ「電子透かし」が必要なのか

今回の背景にあるのは、EU AI Actという規制です。OpenAI社の発表によると、この法律は生成AIのプロバイダーに対し、生成されたテキストを機械が読み取り可能な方法で識別できるようにすることを求めています。

AIが生成した文章が人間が書いたものと見分けがつかなくなると、情報の出所が不明確になり、なりすましや偽情報の拡散といったリスクが高まります。そこで、人間には見えないけれどコンピューターにはわかる「印」をテキストに忍ばせることで、その文章がAIによって作られたものであることを証明しようという試みです。

OpenAI社は、すでに画像や音声については識別ツールを公開していますが、テキストの識別はより難易度が高いため、今回の段階的な導入というアプローチをとったと説明しています。

新技術「textGrain」の仕組みと特徴

今回公開された技術「textGrain」は、モデルが単語を選択する際に、目に見えない統計的な信号を組み込むというものです。

AIが文章を作る際は、次にどの単語(トークン)を使うかを確率的に選びます。例えば「速い」という言葉を使いたいとき、「迅速な」や「スピーディーな」など、意味がほぼ同じで置き換え可能な選択肢がいくつかあります。textGrainはこの選択の余地を利用し、秘密鍵に基づいたランダム性と結びつけることで、統計的なパターン(信号)を文章に埋め込みます。

この仕組みのポイントを整理すると以下の通りです。

  • 不可視性: 特殊な文字や不可視のスペース、不自然な句読点を追加するわけではないため、コピー&ペーストしても隠しデータは混入せず、人間には普通の文章に見えます。
  • 検出方法: 秘密鍵を持つ検出器が文章をスキャンし、textGrain特有の統計的信号があるかを確認することで、OpenAIのモデルで生成されたかを判定します。
  • 品質への影響: 信号を埋め込む際に「エントロピー予算」という制限を設けており、モデルが犠牲にする多様性を抑えています。これにより、ウォーターマークがある場合とない場合で、AIの性能に大きな差が出ないよう設計されています。

OpenAI社が行った評価では、textGrainはGoogle DeepMind社の「SynthID」を含む他の手法と同等か、それを上回る性能を示したとされています。

技術的な限界と今後の課題

非常に高度な技術ではありますが、OpenAI社はこれがまだ初期の技術であり、大きな制限があることも認めています。

特に、検出の信頼性については完璧ではありません。検出器は、ウォーターマークがないのに「ある」と判定する「偽陽性」や、あるのに「ない」と判定する「偽陰性」という2つのエラーを起こす可能性があります。

調査の結果、以下のような傾向が判明しています。

  • 文章の長さ: 文章が長いほど検出率が上がります。例えば心理学などのコンテンツでは、200トークンの文章での検出率は約80%ですが、400トークンになると約95%まで向上します。
  • 内容による違い: 数学のように単語の選択肢が少ない(自由度が低い)コンテンツでは、検出率が大幅に低下します。
  • 編集による影響: 文章が書き換えられると検出は難しくなります。400トークンの文章で、単語の10%を類義語に置き換えただけで、検出率は約92%から66%に低下し、25%を置き換えると17%まで下がりました。

こうした限界があるため、検出ツールの一般公開はせず、まずは承認された研究者や専門組織に限定してアクセス権を提供し、技術の評価と改善を行うとしています。

日本の利用者や今後の展開への影響

今回の導入は、まずEU域内の用户および世界的なAPIユーザーが対象となっており、世界的なデフォルト設定として導入されるわけではありません。

日本のChatGPT利用者への影響については、現時点の発表ではEU域内での導入が中心となっており、日本で同様の機能が強制的に導入されるという具体的な記述はありません。ただし、API経由で利用している場合は、世界的にオプトイン形式で選択可能になります。

今後の展望として、OpenAI社はtextGrainの技術をオープンソース化し、他者がこの技術をベースに開発できるようにしたいと考えています。また、編集や翻訳が行われた場合にウォーターマークがどのように維持されるかの研究や、AIによる「支援」と「執筆」をより有意義に区別する方法を模索し、検出精度を向上させていくとしています。

まとめると、AI生成コンテンツへの透明性を高めるための大きな一歩ではありますが、完璧な検知手段ではなく、あくまで補助的なツールとして運用されていくことになりそうです。

出典 Our approach to EU text provenance rules OpenAI is adding text watermarking in ChatGPT and Codex PYMNTS | OpenAI Rolls Out Text Watermarks to Meet EU AI Act Mandates OpenAI Begins Phased Text Watermarking Under EU AI Act Rules – Unite.AI OpenAI Opens Text Watermarking, Plans EU ChatGPT Rollout – FourWeekMBA OpenAI unveils textGrain, a new text watermarking system OpenAI rolls out text watermarking under EU AI Act rules | LavX News

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!
目次