OpenAI、ChatGPTの生成文に電子透かし EUで導入へ
文章の種類と長さが透かし検出率に与える影響
OpenAIは、ChatGPTやCodexが生成するテキストに、AIによる生成・処理を識別するための電子透かしを導入する。EUでは今後数週間かけて対象となるChatGPTとCodexの出力に適用する。APIでは10月5日から世界の利用者が一部モデルで任意に有効化でき、初期設定ではオフとなる。
EU AI法が生成AI事業者に対し、生成テキストを機械で識別可能にすることを求めていることへの対応。OpenAIが開発したテキスト透かし技術「textGrain」を利用する。
textGrainは、文章に特殊な文字やメタデータを付加するのではなく、モデルが文章を生成する際の単語選択に目に見えない統計的な信号を加える。専用の検出器でこの信号を調べることで、文章にOpenAIの透かしが含まれているかを判定する。
一方、OpenAIは透かしによる判定には限界があるとしている。偽陽性や偽陰性が発生する可能性があり、文章が短い場合や、単語の選択肢が少ない内容では検出が難しくなる。
同社の評価では、偽陽性率を1%に設定した場合、心理学などの文章では200トークンで約80%、400トークンで約95%の透かしを検出した。一方、数学など単語選択の自由度が低い内容では検出率が大幅に低下した。
文章を編集した場合も透かしは弱くなる。400トークンの英語文章で単語の10%を類義語に置き換えた実験では、検出率が約92%から66%に低下。25%を置き換えると17%まで低下した。
文章の編集が透かし検出率に与える影響
透かしが検出された場合でも、文章に人間がどの程度関与したかや、文章の所有者、責任の所在、利用者の身元などは判別できない。内容の正確性を保証するものでもない。逆に透かしが検出されなかった場合も、人間が作成した文章であることを証明するものではない。
透かし検出機能は当初、承認された研究者や専門機関に限定して提供する。OpenAIは、検出漏れや誤検出の可能性があることから、一般向けには公開しない方針。
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.

