先日Anthropicは、Claudeが生成するテキストや画像に「機械可読なマーク」を付与する仕組みを導入することを発表しました。EUで定められたAI法の透明性要件に合わせるためのものですが、透かしの埋め込みは利用地域に変わらず全世界のユーザーが影響を受けます。この発表では、テキストにマークを埋め込む技術的な詳細は説明されていませんでしたが、テキストに「透かし」を入れる技術を主要なAI企業は導入しており、例えばGoogleはGemini向けの仕組みを詳しく紹介しています。画像と異なり、テキストに透かしを入れることは不可能に思えますが、この制限を突破する方法が存在するのです。AIが選ぶ単語の確率を微調整するテキストに透かしを埋め込む仕組みの確信は、AIが選ぶ単語の確率を微調整するというものです。LMは文章をトークン(単語や語の一部)ごとに生成します。次に来るトークンの候補にはそれぞれ「確率」があり、もっとも自然なものが選ばれます。例えば「big」と「large」がほぼ同じ意味で同じくらい自然な場合、通常ならどちらを選んでも問題ありません。ここで企業は、特定のパターンに従って片方の確率をわずかに上げ、もう片方を下げるという微妙な偏りを仕込みます。文章の意味は変わらず自然なままですが、どの単語を選んだかという選択の履歴が透かしとして残ることになります。この偏りは一文だけではほぼ分かりませんが、文章全体にわたって適用されるると、企業側の検出ツール(GoogleならSynthID)がそのパターンを読み取ることができるようになるのです。この透かしは文章の構造や文体とは無関係で、人間が読んで自然な文章でも透かしは残るということになります。ただし以下のような弱点も存在します。一文だけでは透かしが成立しない人間が大幅に書き換えるとパターンが壊れる別のAIに「ランダム化して」と頼むと、そのAIの透かしが付く透かしは万能ではありませんが、企業が透明性や法的要件を満たすための仕組みとして機能しています。まとめ企業が透かしを導入する理由は、法規制への対応、透明性の確保、ブランドの識別など多岐にわたります。ただし透かしの具体的なパターンは企業内部の検出器だけが知る情報であり、通常外部には公開されません。Googleは比較的詳細を公開していますが、Anthropicなど他社の方式は不明で、各社が独自の仕組みを採用している可能性があります。AIが生成する文章は、表面上は自然でも、裏側では単語選択の確率を微調整することで透かしが埋め込まれているという事実を知っておく必要があります。[via Neowin]