Claudeのテキスト電子透かし導入 (2026-08)
#llm #ai #security #watermarking #anthropic #claude
Anthropic が2026-08-11に、Claude の生成テキストへ知覚不能な電子透かしを埋め込むと発表した。2026-08-02以降にリリースされる新モデルすべてが対象で、旧モデルへも順次拡張予定とのこと(現行のモデル階層でいうと2026年8月以降の新モデルから)。
背景: EU AI Act
直接の契機は EU AI Act 第50条(透明性義務)。2026-08-02から新規リリースのAIシステムに対して施行され、生成AIの出力に機械可読なマークを埋め込むことを提供者に義務付けている。Anthropic は EU 域内限定ではなく全世界のトラフィックに一律適用する方針を取った。
実装の特徴(公表情報から)
- モデルレベルの埋め込み: 特定アプリが後付けするのではなくモデル出力自体に入るため、Claude API / claude.ai / Claude Code / Claude Cowork / Claude Tag、さらに AWS・Google Cloud・Microsoft Foundry 経由のアクセスまで経路を問わず適用される。
- テキストの意味・可読性は変えないとしている(アルゴリズムの詳細は非公開)。
- コピペしても透かしは残り、多少の編集にも耐えることがある。
- 画像・ファイルには C2PA 標準の署名付きメタデータを使う(テキスト透かしとは別レイヤー)。
- 検出用のツールと技術仕様を公開し、サードパーティも検証できるようにする予定。
限界(Anthropic自身が明記)
- 大幅な書き換え・言い換え・翻訳・人間の文章との混合で検出不能になりうる。
- 検出されるのは「Claudeが処理した」ことまでで、Claudeが著者であることの証明にはならない。人間が書いたテキストをClaudeに通しただけでもマークは付きうる。逆に、透かしが無いことは人間が書いた証明にもならない。
発表を受けた解説記事(Kaito Sugimotoさん)では、「言い換えで消える」という記述から、2026年時点の研究の主戦場である意味空間型の言い換え耐性(SemStampやPASAの方向)はまだ備えていないのではと推測されている。
出典
- How Claude marks AI-generated content (Claude Help Center)
- Anthropic says it will watermark text generated by its AI models (TechCrunch, 2026-08-11)
- EU compliance, delivered globally (Euronews, 2026-08-11)
- 30年後の未来では、AIの出力したテキストに電子透かしが入っているかもしれない (Zenn)