テクノロジー

Claude がテキストに電子透かしを入れ始めたので、LLM ウォーターマーキングの仕組みを調べた

1: tomoP 2026/08/13 05:42

Google翻訳の中身が早々にGeminiに置き換えられたのは透かし除去対策かねぇ

2: t_f_m 2026/08/13 06:12

"実際、2023年の時点で「パラフレーズモデルを1回通すだけで既存の検出器がほぼ全滅する」ことが実証されており[8]、この攻撃は今でもテキスト透かしの最大の弱点です"

3: tohokuaiki 2026/08/13 06:27

へぇ。なんかすごいな。頭いい人はAIやるわ、そりゃ。

4: yayamosezu 2026/08/13 06:34

透かし

5: Fushihara 2026/08/13 06:38

AIで作ったか否かだけではなく誰が作ったかのbit列まで含めるとかマジで不快だわ あー気持ち悪い気持ち悪い

6: naozane2 2026/08/13 06:42

増田の文章もgeminiやチャッピーに聞けば透かしが判定できるのかね。透かしを消すローカルLLMが流行りそう。

7: Unite 2026/08/13 06:52

"鍵を埋め込むことによりテキストの品質が下がるはず" 俺もそう思ってるが、そもそも品質とはなんぞやなんだよな ただでさえ日本語はベンチが当てにならんのに/全体の意味が同じだろうと語彙変えたら雰囲気変わるで

8: marmarossa 2026/08/13 06:53

“い”

9: nguyen-oi 2026/08/13 07:08

テキスト透かしが実現不可能な夢物語から実用段階に入った技術的背景がよくわかる

10: amd64x64 2026/08/13 07:24

電子透かしの消し方もAIに頼めばやってくれるのかな

11: civicpg 2026/08/13 07:28

縦読みみたいなのの複雑なもやつかと思ってた

12: lli 2026/08/13 07:43

なるほどなぁ よく考えるわ

13: hhungry 2026/08/13 07:45

プログラムにも入れるんか?

14: btei 2026/08/13 07:54

一般文章や意味的に等価なら同じ動作するコードならともかく、ごく一部の純文学的な小説のライティングにはかなりダメ。(やってることが正にバッティングしてる)

15: ledsun 2026/08/13 08:01

「サンプリング」というのはパラメーターでいうとtemperatureのことかな?これを固定乱数にしたら品質変わらずに意図的な偏りが作れるって発想面白いな。その反面temperatureチューニングができなくなるのも面白い。

16: Lycoris_i 2026/08/13 08:06

なるほど、わからん……

17: Ep7TUEiW 2026/08/13 08:10

「秘密鍵」がでてきた後に「鍵」と注記なしに来たら秘密鍵の略なのかと思ってもおかしくはなさそう。また、秘密鍵でなくとも「鍵を埋め込む」は説明内容にそぐわない表現に思う。

18: ssssschang 2026/08/13 08:17

AI構文が加速するんでないかなと疑ってる。あれだって言語的な違和感があるわけではない話し方のクセのようなもんだし

19: hogetax 2026/08/13 08:18

直感としてはハーネスと複数LLM利用が邪魔する気がするなぁ...

20: ukn 2026/08/13 08:22

文書に暗号を含ませられるってことやん。虐殺器官みたいやん

21: yto 2026/08/13 08:23

AI出力そのままのやつはすぐわかるよという

22: kihee 2026/08/13 08:38

論文などのある程度長さのある文章なら高い確率で検出できそうだけど、SNSで書かれるような短い文章では無理そう。文体を真似させたエッセイなんかでも厳しそうだなぁ……

23: ebibibi 2026/08/13 08:43

これはこの先、特に企業で重視されそうな話題ですね。

24: sabro 2026/08/13 08:54

電子透かしを確認することで、AIの学習データにAI生成物が混入するのを防げそうだから、AI企業にとってはむしろ入れたかったんじゃないか

25: LM-7 2026/08/13 08:56

1~6の値が均等にでる偽サイコロを使っているだけでその結果は通常と変わらない(品質は劣化しない)。一方、鍵を持つ検出者にはテキストに含まれる単語は偽サイコロの値がいつも高めということが分かる

26: toro-chan 2026/08/13 09:03

人間が確認した事実の方が勝ってると思う。つまりこれでAI由来だと証明されても、人間が「見た」という事実で、AIではなく人間が作ったことにならないとおかしい。なので使える所は面白ネタ程度では。

27: Cru 2026/08/13 09:05

決定論的なGumbel-Maxなら短文でも効きそうだが、確かに同じプロンプトには同じ答えが還るな。各ユーザ毎の初期プロンプトをセッション毎に更新すれば多様性は保たれるけど。他の方法は確率が有意になる一定量が必要そ

28: n2sz 2026/08/13 09:11

色々と手法はあるんだなあ。ある程度の情報も埋め込めるのか。複数のAI経由させたらどうなるかな。

29: tettekete37564 2026/08/13 09:23

テキストに電子透かし!?どうやって?という感じだったので大変勉強になった

30: eos2323 2026/08/13 09:29

3のつく数字の時だけ声が大きくなる人みたいな感じ。傍目にはただカウントアップしてるだけに見える。95%の確率でAIですと言われたとして、果たしてそれを信じていいものか

31: napsucks 2026/08/13 09:30

てっきりUTF8のゼロ幅スペースや古典的な句読点の位置でも使うのかと思ったら、もっと根本的な部分に埋め込んでた。

32: dltlt 2026/08/13 09:31

人間の書き方の癖も「偏り」だし、書きたい内容(意味)が秘密鍵由来の「当たり領域」に偶々入ってしまうこともあるだろうから、擬陽性かなり出そうに思う。

33: zentarou 2026/08/13 09:43

人間がAI臭さとして違和感を学習しそう

34: hobbiel55 2026/08/13 09:47

"人間が書いた文章を Claude に校正させただけでも透かしは付くので、透かし検出を「AI が書いた証拠」として扱うのは誤り"←応募された論文や小説からAI生成のを検出するのに使えるかと思ったがこれだとどうかな。

35: n_y_a_n_t_a 2026/08/13 10:00

テキストに電子透かしを入れるというアイデアを研究している人がいるだけでとてもエキサイティングに感じた。原理は全く理解できないが……

36: gmym 2026/08/13 10:05

面白かった

37: Kmusiclife 2026/08/13 10:06

要するに完全に生成スタートすると透かしが強くなるということのように思う。

38: Retset 2026/08/13 10:10

長文のブログに実はマルウェアのコードが埋め込まれていた、とかそのうち出てきそう

39: takilog 2026/08/13 10:10

昔からAI生成に対するウォーターマークの研究はいろいろありますからね

40: torish 2026/08/13 10:13

うぜえ回答もこのためか?別生成AIで確認とるときコピペすることがあるけど、Geminiくんところの回答だねってバレてるのか。そのうち他AI生成文は受け入れません!とかなりそう

41: yarumato 2026/08/13 10:17

“テキストの透かしは「単語選択の癖」として埋め込む。「鍵を埋め込むことによりテキストの品質が下がるはず」という課題への対処。「単語を言い換えられたら鍵となる情報が消えるはず」という課題への対処”

42: otchy210 2026/08/13 10:27

言い換え耐性はなるほど、と思ったがそれすら「大意は変えずに文章量を倍にして」「大意は変えずに文章量を半分にして」って二回通せば壊せそうよな。

43: otoan52 2026/08/13 10:31

top-pみたいな選択肢を偏らせる感じかな。日本語だと表現の揺れ幅許容度が高くなりそう。数理モデルとLLMの交差するところの話は面白い。

44: akiramaz 2026/08/13 10:32

専門的な文章なのに読みやすくて面白い

45: pj_lim 2026/08/13 10:44

ふむ、わからん

46: anonymighty 2026/08/13 10:48

虐殺器官みたいに人間の考えに影響を与えるような言葉選びもできそう・・・。

47: s17er 2026/08/13 10:56

AIっぽい文章ってのがそのままウォーターマーキングとなるみたいな

48: mochinaga 2026/08/13 11:06

プログラムにもウォーターマークいれるのすごい技術

49: dollarss 2026/08/13 11:14

日本語ではかなり難しそうだが…それができるなら凄いよな。

50: chaoschk 2026/08/13 11:30

やはり、翻訳を2回かけると透かしは消えて文意は変わらず読めるのね。翻訳サイトのDeepLは電子透かし消去サービスで生き残れるかも?

51: hirorinya 2026/08/13 11:30

私の言葉遣いがAIに寄っていってる

52: hazlitt 2026/08/13 11:33

AI or 人間テストを作りたい/原理的には当該モデルでない者(人間含む)が捏造できるのではないかという気がしているのだがな

53: laranjeiras 2026/08/13 11:33

「秘密鍵」のところが引っかかる。一部の「秘密鍵」は「公開鍵」なのではないだろうか。Claude側が秘密鍵で埋め込んだものを、公開鍵で検証する技術なのではないだろうか。

54: hoge_hoge_123 2026/08/13 11:40

こういったテキストの癖を脱色する手法が出てきそうだけど

55: rogertroutman 2026/08/13 11:45

電子透かしを実装していない翻訳サービスで他言語に翻訳して元に戻せば剥がせそうな気がする。しかし透かしが単語の選択じゃなくて文脈に練り込まれてたらだめか

56: shoh8 2026/08/13 12:16

えー、すごい。表面上のテキストには現れないトークンを保持できるって、虐殺器官(著:伊藤計劃)もうすぐじゃん。

57: spray_donuts_3co 2026/08/13 12:33

今でさえ、AI出力の文章に「なんとなく」癖を読み取ってるわけで、これからもその不自然さ、違和感は残るということだね。ありがたい話だ。

58: Falky 2026/08/13 12:34

ふ〜むなにもわからない

59: urtz 2026/08/13 12:51

すごい。そんなことが可能なのか。でも透かし除去オープンモデルが必ず出てくる。

60: r-west 2026/08/13 12:59

モデルがベストとして出すはずの結果に別の尺度の歪みを埋め込むのだから、品質が下がるのはやはり必定で、それをどう影響を抑えて埋め込むかの話ね

61: stabucky 2026/08/13 13:00

新しい情報はほとんどなかった。

62: altar 2026/08/13 13:37

“透かしを埋め込む場所をトークンから 意味空間(embedding space) へ移すというアプローチ” 分子系統解析が形質ベース分類学を過去の物にしたような、従来の言語学とは全く別の工学的なパラダイム凄いなあといった印象

63: secseek 2026/08/13 14:29

人間が書いたのに誤検出されるとかがありそうですねぇ

64: kuippa 2026/08/13 14:43

それって膠着語でもできるんだろうか? 日本語みたいに語彙で揺らすには助詞ぐらいでしかマークできない気がするが。てっきりUnicodeの不可視文字でやるのかとおもってた。

65: toyoshi 2026/08/13 14:53

マルチバイト文字なら普通に埋め込めそうだけどそういう技術もあるのだろうか。半角英数がなくなる日も来るかも。

66: defiant 2026/08/13 15:39

この記事をおすすめしました

67: casm 2026/08/13 15:44

おもろいなぁ

68: bxmcr 2026/08/13 16:03

私も無理なのでは、と思っていました💦技術の進歩の早さ!

69: misshiki 2026/08/13 16:05

Claudeが生成文への電子透かし導入へ。単語選択の統計的な「癖」で検出し、品質を変えない方式も実用化。一方、言い換え・翻訳には弱く、検出されても「Claudeが著者」の証明にはならない。

70: rgfx 2026/08/13 16:28

embeddingの話だ

71: oktnzm 2026/08/13 16:48

DSSS的な何か

72: everybodyelse 2026/08/13 16:51

暗号化すればいけるんか?

73: star_123 2026/08/13 17:53

全然人を豊かにしてくれなさそうな技術だな

74: Helfard 2026/08/13 18:15

それ、むっちゃ重要。って3回くらい入ったりするんか?

75: harumomo2006 2026/08/13 18:41

選択肢を制限してる時点で劣化してると思うんだけど違うの?

76: mag4n 2026/08/13 18:44

まーたトークン消費しそうなことを。

77: escape_artist 2026/08/13 19:03

新聞に犯行予告をするシリアルキラーを文章のクセで追い詰めるやつっぽい

78: enjoymoon2 2026/08/13 22:10

レポートや論文にAI使ったらバレるのが加速するのかしら? いたちごっこになりそうではあるが。

79: siitakke 2026/08/14 00:06

長文は論文などお堅いのが多いから英語で出力させて、それを翻訳させたら透かしとか何の意味も無いのよね