Claudeの文章、こっそり透かし入ってた
Anthropicが、Claudeの文章に忍ばせる電子透かしの仕組みを公式解説。単語選びのクセにパターンを仕込みAI生成を判定する技術で、品質への影響はないという。
ひなた:ふぁ〜……ことね先輩、前に見せてもらった千円札、光にすかすとちっちゃい模様が出てくるやつ、あれの仲間が、AIの文章にもあるって聞いたのです……
ことね:うふふ、その発想、案外近いのよ。ただし今回は目に見える柄じゃなくて——Anthropicが公式に仕組みを解説したの。単語の選び方のクセに、こっそりパターンを仕込んでいるのよ。
ひかり:えっ何それ気になるっ! 単語の選び方でバレるってどういうことっ!?
ことね:通常、AIは候補のなかから一番自然な単語を選ぶの。透かしをつけるときは、ランダムじゃなくて「鍵」を使って選ぶクセを作るのよ。それが文章のなかで繰り返し出てくると、AI生成の可能性が高いと判定できる——Google DeepMindの「SynthIDテキスト」っていう技術がベースなの。
みずき:…で、それ誰得なわけ? 私が読む分には得しなくない?
ことね:目的はEUの法令に対応するためなの。内容や創造性、読みやすさへの影響はないってAnthropicは説明してるわ。処理速度もほぼ変わらなくて、近いうちに「透かし検出API」も出すみたいよ。
みずき:…海外だと、もう噛みついてる人いるけど。「文章への冒涜だ」って。
ことね:それ、Daring FireballのGruberさんね。最適な単語じゃなくて、統計的に有利な候補を優先させられるのは、微妙でも文章の質を損なうって主張してるの。EU向けの対応を世界中に広げるのも「お役所仕事の理不尽」だって——
ひかり:えっ、じゃああたしたちが読んでる文章、知らないうちに単語選びを変えられてるかもってことっ!?
ひなた:ふぁ〜……お札の模様とおんなじで、見えないところに何か仕込まれてるって、ちょっとドキドキするのです……
まとめ:見た目も読み心地も変わらないと言われても、"何か仕込まれてる"と知ると、人はどうしても気になってしまう。