Claudeの文章に「見えない目印」 AIが書いた可能性を確かめる仕組みへ

Claudeの文章に「見えない目印」 AIが書いた可能性を確かめる仕組みへの説明画像

Anthropicが、Claudeの文章に読者には見えない目印を残す仕組みを導入します。後からAIが関わった可能性を確かめる方法と、その限界を整理します。

まず要点

Anthropicは、今後のClaudeが作る文章に、後から機械で確かめられる「見えない目印」を残すと発表しました。

目印は読者には見えず、個人や組織、特定の会話を示す情報も含みません。短い文章や大幅に書き直された文章では、判定が難しくなる場合があります。

かんたんにいうと

Claudeが次の言葉を選ぶときには、意味がほぼ同じ候補がいくつかあることがあります。たとえば文の流れによって、「良い」と「素晴らしい」のどちらも自然に使える場面です。

このような選択をするとき、Claudeは検出用の秘密の規則に沿って候補を選びます。その言葉の選び方に見えないパターンが文章全体へ繰り返し残るため、後からClaudeが関わった可能性を調べられます。

目に見える記号や隠し文字を追加する方法ではありません。普通に読んだ人には、目印のある文章とない文章の違いは分かりません。

何が変わる?

Anthropicは、今後のClaudeモデルにこの仕組みを組み込み、2026年8月2日より前に出たモデルにも数か月かけて広げる方針です。検出用のAPIも準備中としています。

EUでは2026年8月2日から、AI提供者にAI生成・加工コンテンツを検出できる機械可読な印を付ける透明性ルールが適用されています。Anthropicはこの対応として、地域を分けず世界向けに導入すると説明しています。

利用者への影響は?

Anthropicによると、この仕組みで文章の内容や読みやすさは変わらず、追加のトークンも使わないため料金は上がりません。Claudeが作った翻訳にも目印は残ります。

ただし、検出結果は「Claudeが関わった可能性」を示すもので、誰が書いたかを特定したり、AI利用を100%断定したりするものではありません。学校や職場では、短文や編集後の文章への限界も考え、判定だけで決めつけないことが必要です。

見えない目印の仕組みと限界

この方式はGoogle DeepMindが公表したSynthID-Textをもとにしています。意味や正確さを損なわない候補が複数あるときだけ、直前の言葉と検出用の鍵に基づく規則で次の言葉を選びます。

長い文章は選択の回数が増えるため、Claudeが関わった可能性を確かめやすくなります。反対に、答えが一つに決まる事実文、正確さが必要なコード、変更の少ない校正では、目印が残る余地が小さくなります。

文章を完全に書き直すと目印は消える場合があります。また、検出APIの提供時期や利用条件は、発表時点では決まっていません。

情報源