OpenAI、EUでChatGPTとCodexの文章に不可視の透かし
導入
OpenAIは、欧州連合(EU)でChatGPTとCodexが生成する文章に、不可視の透かしを加えると発表した。EU AI法の透明性規定への対応が目的だ。同規定は8月2日に発効し、AI生成コンテンツに他のシステムが識別できる印を付けることを求めている。OpenAIによると、この機能は今後数週間かけて、EUの対象ユーザーにプランを問わず展開される。
要点
- 文字そのものにパターンを埋め込む。 目に見える記号ではなく、モデルが次に選ぶ単語をわずかに調整し、読者には分からない統計的特徴を作る。特徴は文章内にあるため、コピー・ペースト後も残る可能性がある。
- 当初はEUが対象。 世界で一律にデフォルト有効にする予定はない。OpenAIのAPIを使う開発者は、世界のどこからでも一部モデルで有効化できるが、初期設定はオフだ。
- 検出には限界がある。 OpenAIの試験では、約10%の単語を同義語に置き換えると検出率が約92%から66%に下がった。短い文章、数学の解答、翻訳文も判定が難しい。透かしが見つからなくても、人間が書いたことを意味しない。文章が短すぎる、編集が多い、別のAIが生成したといった可能性があるためだ。
- 利用者の特定は目的ではない。 OpenAIは、透かしからユーザーを識別できず、有効化してもモデル性能に意味のある変化はなかったと説明している。技術報告書では、秘密鍵で次の単語の予測を整理し、小さな調整を多数積み重ねて検出するtextGrainの仕組みを説明した。
意義と影響
今回の対応は、AI生成物の透明性を、自己申告から機械で確認できる情報へ近づけるものだ。教育、報道、コンテンツ配信、規制対応では、文章の出所を推測する手がかりとして役立つ可能性がある。ただし、モデルがどの程度文章に関与したのか、人間がどれほど判断や編集、創作を加えたのかまでは示さない。少しの書き換えで検出信号が弱まる以上、透かしは著者性や違反を単独で確定する証拠ではなく、補助的な指標と見るべきだろう。
OpenAIは以前にも文章透かしを開発していたが、透かしを導入しない競合サービスへ利用者が移る懸念などから公開を見送ったと報じられている。その後、AnthropicはClaudeの文章に世界規模で透かしを付ける方針を示し、AIを道具として使う人の貢献まで表示対象にすべきか議論を呼んだ。OpenAI、Anthropic、Google、Meta、MicrosoftなどがEUのAI生成コンテンツ向け実務規範に関与するなか、透かしは法令対応とサービス競争の一部になりつつある。今後は、誤検出、検出器へのアクセス、各社方式の互換性が焦点になる。
コメント
ログイン状態を確認中…
コメントを読み込み中…