Showing Posts From

Ai規制

なぜAIの文章はコピペしてもバレるのか?テキスト電子透かしの仕組み

なぜAIの文章はコピペしてもバレるのか?テキスト電子透かしの仕組み

やさしいAI研究所の植木です。 毎日AIを使っていると、自分で文章を書くことがほとんどなくなってしまいました。 あからさまにAIが書いたとバレるのも嫌だなと思い、少し小細工をしてみるものの、そもそもどのような仕組みでバレるのかを知る必要があります。 画像等のファイルなら「作成者情報(メタデータ)」が残るイメージが湧きます。しかし、プレーンテキストをコピペしているだけなのに、なぜAIは判別できるのでしょうか。 その鍵となるのが、テキストに埋め込まれる「電子透かし(ウォーターマーク)」です。この記事では、Anthropic社が公開したブログ記事をもとに、その仕組みを簡単にまとめてみました。 1. はじめに Anthropic社は、2026年8月2日以降に公開されるClaudeが生成するテキストに、目に見えない電子透かしを埋め込むと発表しました。理由は、EU AI Act 第50条への対応です。EU向けの規制対応ですが、現時点では地域を限定せず全世界に適用されているようです。 ちなみに、電子透かしの技術は、Gemini(Google社)が先行しており、2024年からSynthID-Textが本番稼働しており、大規模なテキスト透かしとしては初の実運用例だそうです。 2. よくある勘違い:「見えない特殊文字」が入っているわけではない 「文字の隙間に、透明な特殊文字(ゼロ幅スペースなど)が仕込まれているのでは?」私はこのように思っていたのですが、非常によくある誤解で、違ったようです。Anthropic社の電子透かし技術は、テキストには何も追加されておらず、隠し文字も存在しておりません。読んでも、ごく普通の自然な文章 見た目も文字コードも一般的なテキストのまま メモ帳に貼り付けて書式情報を落としても消えない 文章の質や読みやすさには実質的に影響はないでは、どのような細工が仕掛けられているのでしょうか。 3. 細工:「単語を選ぶときの“サイコロ”の振り方」 結論から言うと、AIの電子透かしは「どの単語を選ぶか」を決める乱数の“出どころ”を差し替えることで実現されています。 AIは文章を作る時に、1単語ずつ選んでいる まず、AIは、文章を一気に書いているのではなく、「次に来る言葉として自然なものを予測して1つ選ぶ」という動作をひたすら繰り返して、文章を作成しています。 たとえば「今日の天気は晴れていて、そして……」という文の続きを考える時に、「辛い」が来ることはまず考えられません。例えば、「心地よい」も「清々しい」も、どちらも自然で、文の続きとしてはあり得る選択肢になります。 こうした「どちらでも良い選択」が、1つの文章の中に何百回も発生します。そして通常、どちらにするかの最終決定は、乱数(コンピューター内部のサイコロ)に委ねられています。 透かしは、その乱数を「鍵」に置き換える 透かしを入れる場合、AIはこの乱数の代わりに、「秘密の鍵」と「直前の数単語」の組み合わせから次の単語を決めています。 重要なポイントは、選択の結果は、依然としてランダムに見えるという点です。「心地よい」に固定されるわけではなく、ある文では「心地よい」、次の文では「清々しい」が選ばれます。また、この仕組みは、AIが本来まず使わないような珍しい言葉を無理に選ばせることもありません。 しかし、「秘密の鍵」を持っている人が後から単語の並びを検証すると、「この並びは、その鍵を使って選んだ場合の結果と一致している」ことが分かります。 Anthropic社自身が挙げている例を紹介します。 ボードゲームのモノポリーで、サイコロを振る代わりに「円周率の数字が延々と書かれた本」を使うとします。適当な桁からスタートし、以降は次の桁の数字をそのまま「出目」として使うというルールです。 プレイヤーにとって、これは普通のサイコロと何ら変わりません。ゲームの体験も結果も同じです。しかし、ゲーム終了後に全ての出目を並べて円周率と照合すれば、「この試合は円周率を使っていたな」と判定できます。 AIの透かし技術と同じ発想です。読み手の体験は変わらないが、後から検証はできます。とある解説記事では、「AIが単語候補を“緑リスト(優先)”と“赤リスト(回避)”に色分けし、緑の単語を多めに選ぶ」という説明をよく見かけます。 この説明は、2023年に発表された別方式(赤・緑リスト方式、John Kirchenbauerらの手法)で、Claudeが採用している方式とは異なります。Claudeが採用している透かしは、Google DeepMindが発表した「SynthID-Text」をベースにしており、単語の出やすさ(確率)そのものを歪めるのではなく、あくまで乱数の生成源だけを置き換える設計のようです。これが「品質に影響しない」と言える根拠にもなっています。 4. なぜコピペしてもバレるのか? 透かしは文字の中ではなく、文章を構成する「単語の並び順」そのものに宿っているからです。 メタデータではないので、書式を捨てても、別のアプリに貼り付けても、テキストファイルに保存し直しても消えません。オーマイガー。並び順が保たれている限り、透かしも一緒についてきます。 逆に言えば、単語やその並び順を全面的に書き換えれば透かしは失われます。軽い手直し程度では消えませんが、すべての語を置き換えるレベルの全面リライトをすれば消えます。そこまで書き直したものを「AIが生成した文章」と呼ぶべきかどうかは、別の議論になりそうですが。。。5. バレやすい/バレにくい文章 この仕組みの性質上、バレやすい/バレにくい文章がはっきりしています。バレやすい文章 文章が長い プログラム中のコメント部分 翻訳した文章バレにくい文章 文章が極端に短い(選択回数が少なく、偶然との区別がつきにくいため) 事実を述べる文章(答えが1つしかない箇所では、選ぶ余地がないため) プログラムコード(正確さが求められ選択の余地が少ないため) 人間の原稿の校正(修正した数語にしか透かしが入らないため)6. 「透かしが検出された=不正」ではない 透かしが示せるのは、「AIが何らかの形で関与した可能性が高い」ということだけです。Anthropic社も、「Claudeが書いた」のか「Claudeが大幅に手を入れた」のかは区別できないと明言しています。例えば、他社のAIが書いた文章は、鍵が違う(方式が違う)ため判定できない。 透かしに個人や組織を特定する情報は一切含まれない。誰がいつ使ったかを追跡することはできない。 自分で書いた文章の「てにをは」だけをAIに直させた場合、修正された数語には透かしが乗り得ますが、修正量が少なすぎて、透かし検出には至らない。しかし、「人間がちゃんと書いたのに疑われるのでは」という懸念が利用者から出ているのは事実で、この技術の運用面での課題として残っているようです。 また、現在世の中にある一般的なAI検出サービス(GPTZeroなど)は、透かしを読んでいるわけではありません。さきほどの「秘密鍵」を持っていないからです。これらは「AIらしい言い回しのクセ」を統計的に見つけ出す、別のアプローチです。 Anthropic社は、今後、透かし検出用のAPIを提供する予定としていますが、2026年8月時点では準備中とされています。現状、「透かしを根拠にAI製だと断定できるツール」は一般に公開されていません。 「コピペしただけなのにバレた」という体験談の多くは、現時点では透かしではなく、従来型のAI検出ツールや、単に人間の目による違和感の指摘である可能性が高いと考えられます。 7. 画像等のファイルは「別の方式」 テキスト以外のファイル(.png、.jpg、.svg など)については、透かしではなくC2PAという業界標準の仕組みが使われます。これは「Claudeが作成・処理した」という情報を、暗号署名付きのメモとしてファイルの作成者情報(メタデータ)に添付するものです。カメラメーカーや写真編集ソフトでも採用されている標準規格で、C2PA対応ツールなら誰でも読み取れます。 まとめAnthropic社のClaudeの電子透かし技術は、特殊文字を挿入しているのではなく「単語選択の乱数の出どころ」に埋め込まれています。 そのためコピペでは消えず、全面リライトで初めて消えます。 透かしは、文章の質には影響がなく、個人を特定する情報も含まれません。 証明できるのは「Claudeが関与した可能性」までで、不正の証拠にはなりません。 一般向けの検出ツールはまだ公開されていない状況です。(2026年8月時点)AI生成物の透明性をめぐるルール作りは、まだ始まったばかりです。だからこそ、仕組みを正しく理解しておくことが、AIを安心して使いこなすための第一歩になりそうです。 参考リンクAnthropic「How Claude's text watermark works」(2026年8月14日) Anthropic ヘルプセンター「How Claude marks AI-generated content」 Google DeepMind「SynthID-Text」論文(Nature, 2024年) C2PA(Coalition for Content Provenance and Authenticity)

AI生成の表示ルールが始まった日|発信者は何をすべきか

AI生成の表示ルールが始まった日|発信者は何をすべきか

はじめに こんにちは、広報・制作担当のmeraです。 2026年8月2日。AIで作ったものに「AIで作りました」と示させるルールが、この日から動き出しました。EUと、アメリカ・カリフォルニア州で。しかも同じ日にです。 ただし、義務がかかる相手はかなり限られています。そこを取り違えると必要のない不安を抱えることになるので、この記事では「誰に、何が」を先に切り分けます。 カリフォルニアの日付は、もとは2026年1月1日でした。2025年10月13日に署名されたAB 853という改正法が、これを8月2日に動かしています。州の議会分析にも知事の署名メッセージにもEUへの言及はないので、狙って揃えたと断言はできません。ただ結果として、大西洋をまたいだ2つの規制が同じ日から同じ方向を向き始めました。 なお、この記事に出てくる日付はすべて現地の暦です。時差があるぶん、先に動き出したのはEUのほう。日本時間に直すとEU側が8月2日の朝、カリフォルニア側が同じ日の夕方にあたります。日本から見ても、8月2日は8月2日のままでした。この記事でわかること8月2日に始まったルールが、誰に何を求めているのか 「来歴(プロベナンス)」という考え方と、その限界 日本でブログやSNSを書いている人が、明日から何をすればいいか8月2日に何が始まったのか EU側で動き出したのは、AI法(AI Act)の第50条です。義務は立場で4つに分かれています。 AIシステムを作って提供する側(プロバイダー)には2つ。相手がAIだと分かる設計にすること、そして生成・加工したコンテンツに機械が読めるマークを埋め込むこと。それを使って世に出す側(デプロイヤー)にも2つ。感情認識や生体分類を使うなら知らせること、そしてディープフェイクを公開するなら「これはAIで作ったものです」と開示すること。 ディープフェイクの定義は第3条にあり、実在の人物・物・場所・団体・出来事に似ていて、本物だと誤認させるもの、とされています。ドラゴンや生身で空を飛ぶ人のような明らかに非現実的なものは含まれません。映画や風刺作品に含まれる場合は、鑑賞を妨げない形での表示、たとえばクレジットや説明欄での明記が認められています。 **制裁金は最大1,500万ユーロ、または全世界年間売上高の3%のいずれか高いほう。**ただし第99条(6)に逆転規定があり、中小企業やスタートアップについては「いずれか低いほう」が上限になります。なお第50条(2)の機械可読マークについては、8月2日より前から市場に出ていた生成AIシステムに限り2026年12月2日までの猶予が入りました。適用開始の13日前、2026年7月20日には欧州委員会が第50条の最終ガイドラインを採択しています。 カリフォルニア側は AI Transparency Act です。対象は月間100万ユーザーを超える生成AIの提供者。**目に見えないメタデータ(latent disclosure)を生成物に埋め込むこと、誰でも無料で使える判定ツールを公開すること、利用者が見えるラベルを付けられる選択肢を用意すること。**対象は画像・動画・音声で、テキストは入っていません。罰則は1違反あたり5,000ドル、違反した日ごとに別の違反として数えられます。 そしてここからが発信者にとっての本題です。2027年1月1日からは、大規模オンラインプラットフォーム(直近12か月の月間ユニークユーザー200万人超)に対して、投稿されたコンテンツに来歴データが入っているかを検出し、ラベルとして表示する義務が始まります。「来歴」とは、要するに何なのか 来歴、英語でいうプロベナンス(provenance)。もともとは美術品の世界の言葉で、「この絵は誰の手を経てここに来たか」という記録のことです。それをデジタルファイルに持ち込んだのが C2PA(Content Credentials)という規格になります。 やっていることはシンプルで、ファイルの中に「誰が」「どのツールで」「いつ」「どう編集したか」を署名付きで書き込む。技術仕様は2026年1月5日にバージョン2.3が公開されました。Googleは来歴の検証機能をまずGeminiアプリで提供し、検索とChromeにも順次広げると発表しています。Pixel 10のカメラアプリは、撮影したすべての写真に署名を付けます。AIで作ったものだけでなく、AIで作っていないものを証明する側にも同じ仕組みが使われ始めています。 私はAdobeのツールを25年ほど使ってきました。数年前、Photoshopの書き出し画面に「Content Credentials」という項目が増えたとき、正直に言うと何も考えずに素通りしていました。今はそこにチェックを入れるのが制作フローの一部になっています。あの頃スルーしていた小さなチェックボックスが、法律の名前で呼ばれる日が来るとは思っていませんでした。 ただし来歴は万能ではありません。スクリーンショットを撮る、画像を圧縮する、SNSにアップロードして再エンコードされる。この程度のことでメタデータは簡単に消えます。C2PAは証拠ではなく、あくまで手がかりです。「来歴がある=本物」ではなく、「来歴がない=何も分からない」というだけ。ここを取り違えると、ラベルのない古い写真がすべて疑わしく見えてしまいます。日本の発信者に、これは関係あるのか 結論から言うと、ブログ記事の本文については、たいていの場合は法的な義務の外にいます。 EU第50条(4)の文章に関する開示義務には、条文そのものに大きな除外規定があるからです。人間がレビューまたは編集上のコントロールを行い、自然人か法人が編集責任を負っている文章は、対象から外れます。AIに下書きを手伝わせても、自分で読んで直して自分の名前で出しているなら、ここに当てはまります。カリフォルニア側にいたっては、対象が画像・動画・音声だけで、テキストはそもそも入っていません。 もちろんEU向けにサービスや広告を出している、欧州拠点から動画を公開しているといったケースでは確認が要ります。それでも、日本の個人ブログにEUの制裁金がいきなり飛んでくる、という話ではありません。 けれど本当に効いてくるのは、罰則ではなく仕組みのほうです。 プラットフォーム側が来歴データを読んで自動でラベルを貼る流れが始まります。カリフォルニアでは2027年1月から義務になり、Googleは検証機能をGeminiアプリから提供し始めました。つまり、自分で何も書かなくても、機械が勝手に「AI生成」と表示する世界がもう組み上がりつつあります。 後から機械に貼られるラベルと、自分で最初から書き添えたひと言。同じ情報でも、読む人の受け取り方はまったく違います。前者は「隠していたのがバレた」に見えて、後者は「最初から言っていた」になる。この差は、記事の内容がどれだけ良くても埋められません。 だからAI利用の明示は、罰則を避けるための作業ではありません。法的には書かなくていい立場だからこそ、自分から書く。それが自分のコンテンツの信用を守る作業になる、と考えています。今日からできること 書いたところを、書く。 全工程を報告する必要はありません。「構成案はAIと壁打ちしました」「アイキャッチは画像生成AIです」「本文は自分で書きました」。この程度の一行を記事末に置くだけで十分です。むしろ細かすぎる開示は読みにくくなります。 画像の来歴を、途中で壊さない。 生成ツールの書き出し設定でContent Credentialsを有効にしておく。そのうえで、リサイズや圧縮のツールがメタデータを剥ぎ取っていないかを一度確認してください。私も画像圧縮を挟んだ時点で来歴が消えていたことがあり、工程を組み替えました。 表記のしかたを、サイト内で1つに決める。 記事ごとに書き方が違うと、書いていない記事が「AIを隠した記事」に見えてしまいます。文言と置き場所をテンプレート化して、全記事で同じにしておくのが安全です。まとめ2026年8月2日、EU AI法第50条とカリフォルニアAI Transparency Actが同じ日に動き出した。カリフォルニアは施行日を1月1日からこの日に延期している。 求められているのは、機械が読めるマークと、人が見て分かるラベルの両方。来歴(C2PA)はその土台だが、スクショや圧縮で簡単に消える手がかりでしかない。 人間が編集責任を負うブログ記事の本文は、EUの開示義務の対象外。カリフォルニアもテキストは対象にしていない。それでもプラットフォーム側が自動でラベルを貼る時代になるため、自分で先に明示しておくことが信用を守る。次に読むのがおすすめの記事【セミナー登壇記】高級シニアレジデンスでの60分間〜AI時代の「正しく疑う力」と人生経験の相乗効果〜 「やさしいAI」とは何か——便利さを超えた、人に寄り添うAIを考える参考文献・出典欧州委員会「EU AI法 第50条 透明性義務」適用開始(2026年8月2日)/ ITmedia NEWS EU Artificial Intelligence Act, Article 50: Transparency Obligations / artificialintelligenceact.eu EU Artificial Intelligence Act, Article 99: Penalties(制裁金・第99条(4)(g)および(6)) / artificialintelligenceact.eu 欧州委員会「Guidelines on transparency obligations for providers and deployers of AI systems」(2026年7月20日採択) / digital-strategy.ec.europa.eu California AB 853 (2025) California AI Transparency Act / California Legislative Information California SB 942 California AI Transparency Act / California Legislative Information Content Credentials C2PA Technical Specification 2.3(2026年1月5日) / spec.c2pa.org Google「How Pixel and Android are bringing a new level of trust to your images with C2PA Content Credentials」 / blog.google