OpenAIがChatGPTとCodexのテキストに電子透かしを導入、EU AI法対応で何が変わるのか
OpenAIの電子透かし導入、3つの対応範囲
EU域内
数週間以内にChatGPTとCodexの対象テキストへ透かしを導入
API利用者(全世界)
対象モデルの透かしを任意でオンにできる
検出器
承認された研究者のみに開放
室谷代表取締役出ましたね。OpenAIがEU AI法対応で、ChatGPTとCodexのテキストに電子透かしを入れると発表しました。
これはかなり大きな転換点なんですよね。
これはかなり大きな転換点なんですよね。
テキトー教師DotAI 認定講師そうなんですよ。これまでOpenAIは画像と音声の来歴検証ツールは出していたんですが、テキストは技術的に難しいという理由で慎重だったんです。
それが今回、規制対応という形で踏み込んだわけです。
それが今回、規制対応という形で踏み込んだわけです。
室谷代表取締役発表の主語はあくまでOpenAIですからね。Xで投稿されたからといって「Xが発表」ではないですし。
テキトー教師DotAI 認定講師そこは大事です。で、内容を整理すると、EU域内では数週間以内にChatGPTとCodexの対象テキストに透かしが入る。
API利用者は全世界で対象モデルの透かしを任意でオンにできる。検出器は承認された研究者のみに開放、という三段構えの発表です。
API利用者は全世界で対象モデルの透かしを任意でオンにできる。検出器は承認された研究者のみに開放、という三段構えの発表です。
室谷代表取締役なるほど。いきなり全員に強制ではなく、段階的にやるというのがOpenAIらしいというか、現実的なラインを取ってきたなと。
テキトー教師DotAI 認定講師ええ。公式ページでも「phased approach(段階的アプローチ)」という言葉を使っていて、技術の限界を認めた上で進める姿勢がはっきり出ています。
テキスト電子透かしとは何か——見えない統計的シグナルの仕組みと『わかること・わからないこと』
テキスト電子透かしで「わかること・わからないこと」
わかること
- 検出器が統計的シグナルを探し、「この文章はOpenAIのモデルで生成された可能性が高いか」を判定できる
- 公式の問い「Was this likely generated by an OpenAI model?」という一つの問いに答える
わからないこと
- 誰が最初に書いたか
- 誰が所有しているか
- 個人の特定
- 組織の特定
- アカウントの特定
- 会話の特定
- プロンプトの特定
室谷代表取締役ここが一番読者が知りたいところだと思うんですけど、テキストの電子透かしって、そもそも何をしているんですか。
テキトー教師DotAI 認定講師OpenAIの説明によると、テキスト生成のときに「目に見えない統計的シグナル」を単語の選び方に埋め込むんです。技術名は「textGrain」と公式ページに書かれています。
室谷代表取締役単語の選び方に統計的なクセを仕込む、と。見えるマークや特殊文字は付けないんですよね。
テキトー教師DotAI 認定講師はい、そこは明記されています。で、検出器がそのシグナルを探すことで「この文章はOpenAIのモデルで生成された可能性が高いか」を判定する。
室谷代表取締役ここ、誤解されやすいんですけど、透かしが答えられる問いは一つだけなんですよね。
テキトー教師DotAI 認定講師そうなんですよ。公式の説明でも「Was this likely generated by an OpenAI model?」という一つの問いに答えるものだと書かれています。
誰が最初に書いたか、誰が所有しているか、個人・組織・アカウント・会話・プロンプトの特定はできない。
誰が最初に書いたか、誰が所有しているか、個人・組織・アカウント・会話・プロンプトの特定はできない。
室谷代表取締役つまり「これはOpenAI製っぽい」までしか言えないと。
テキトー教師DotAI 認定講師単に「AIかどうか」を判定する話じゃないんですよ。OpenAIのモデルかどうか、という限定的な話なんです。
室谷代表取締役あと、性能への影響も気になるところですけど。
テキトー教師DotAI 認定講師公式には、テストの範囲で透かしがモデルの能力や速度、回答の読みやすさに影響しなかったと説明されています。
室谷代表取締役そこは安心材料ですよね。MYUUUでも普段からChatGPTやCodexを業務で使っているので、品質が落ちないなら導入自体は歓迎かなと。
テキトー教師DotAI 認定講師講座でも受講生さんから「透かしで文章が不自然にならないか」とよく聞かれるんですが、現時点の説明ではそこは問題ないとされています。
いつから、どこで始まる? ChatGPT・Codex・APIでの導入範囲と有効化の方法
ChatGPT・Codex・APIでの透かし導入範囲と有効化
EU域内のChatGPT・Codex
- 数週間以内に対象テキストへ不可視の透かしを追加
- EU AI法の要件に対応するため(生成テキストを機械可読な形で識別可能にする義務)
- EU域内では対象テキストに透かしが付与される
API(全世界)
- 全世界のAPI利用者が「対象モデル」で任意にオンにできる
- デフォルトはオフのまま
- 公式ページに「Starting today, API customers globally will be able to opt in」と記載=発表当日からオプトイン可能
- 対象モデルが具体的にどれかは現時点で未公表(続報待ち)
室谷代表取締役で、実際にいつからどこで始まるのか。ここを整理しておきましょう。
テキトー教師DotAI 認定講師まずEU域内では、数週間以内にChatGPTとCodexの対象テキストに不可視の透かしが追加されます。
室谷代表取締役これはEU AI法の要件に対応するためですよね。EU AI法は生成AI事業者に対して、生成テキストを機械可読な形で識別可能にすることを求めていると。
テキトー教師DotAI 認定講師そのとおりです。で、APIは別枠で、全世界のAPI利用者が「対象モデル」で任意にオンにできる。
ただしデフォルトはオフのままです。
ただしデフォルトはオフのままです。
室谷代表取締役デフォルトオフというのは大きいですよね。開発者としては自分で選べるわけですから。
テキトー教師DotAI 認定講師公式ページには「Starting today, API customers globally will be able to opt in」と書かれています。つまり発表当日からオプトイン可能です。
室谷代表取締役対象モデルが具体的にどれか、というのは現時点では明らかにされていません。ここは続報待ちですね。
テキトー教師DotAI 認定講師そうですね。あと、画像と音声の検証ツールはこれまで通り公開されていて、openai.com/verifyのウェブツールとContent Provenance APIは誰でも使える状態が続きます。
室谷代表取締役テキストだけ別扱いというのが、いかにテキストの透かしが難しいかを物語っていますよね。
透かしの限界——短い文章では検出困難、書き換えや翻訳で消える理由
室谷代表取締役ここが今回の発表で一番正直だなと思ったところなんですけど、OpenAI自身が「現行技術の重大な限界」を明示しているんですよね。
テキトー教師DotAI 認定講師はい。具体的には、短い文章では透かしが検出できないことが多い。
そして書き換えたり翻訳したりすると、透かしが完全に消える可能性がある。
そして書き換えたり翻訳したりすると、透かしが完全に消える可能性がある。
室谷代表取締役翻訳で消えるというのは、言語をまたぐと単語の選択パターンが根本的に変わるからですよね。
テキトー教師DotAI 認定講師そこは技術的な構造上の問題です。統計的シグナルを単語選択に埋め込んでいる以上、単語が置き換わればシグナルも失われる。
室谷代表取締役つまり、透かし入りの文章でも、誰かが少し手を加えれば検出できなくなる。これは「透かしがあればAI生成を完全に判別できる」という期待には応えられないということです。
テキトー教師DotAI 認定講師単に「透かしを入れたから安心」な話じゃないんですよ。OpenAIも「strong performance under ideal conditions does not guarantee reliable detection in everyday use」と書いていて、理想的な条件下での性能が日常利用での信頼できる検出を保証するものではないと明言しています。
室谷代表取締役検出器のエラーも2種類あると。透かしがあるのに「ない」と言うエラーと、ないのに「ある」と言うエラーですね。
テキトー教師DotAI 認定講師公式ページではその2種類のエラーに触れた上で、それでも完全ではないという立場を示しています。
室谷代表取締役これは教育現場で使うときに注意が必要ですよね。透かしがないからといって人間が書いたとは言えないし、透かしがあるからといって100%AIとも言い切れない。
テキトー教師DotAI 認定講師講座でも「AIチェックツールの結果を絶対視しないでください」と伝えているんですが、今回の発表はまさにその慎重さが必要だという裏付けになりました。
検出器はなぜ承認された研究者だけ? 検出方法と精度をめぐる現状
室谷代表取締役検出器が承認された研究者と専門機関だけに限定される、というのも今回のポイントですよね。
テキトー教師DotAI 認定講師はい。OpenAIは検出器へのアクセス申請を開始していて、当初は技術の評価と改善に協力できる承認された研究者・専門機関に限定されます。
室谷代表取締役なぜ一般公開しないのか。
テキトー教師DotAI 認定講師理由はシンプルで、まだ評価と改善の段階だからです。技術が成熟していない段階で広く公開すると、誤検出による誤解や悪用のリスクが大きい。
室谷代表取締役逆に言えば、検出器が一般に配られていない以上、現時点で誰でも手軽に「この文章に透かしがあるか」を確認する手段はないわけです。
テキトー教師DotAI 認定講師そうなります。検出精度についても、具体的な数値は今回の発表では明らかにされていません。
textGrainの技術レポートが今後数週間で追加詳細とともに更新される予定で、技術をオープンソース化する計画も示されています。
textGrainの技術レポートが今後数週間で追加詳細とともに更新される予定で、技術をオープンソース化する計画も示されています。
室谷代表取締役オープンソース化は面白いですよね。他の開発者がその上に何かを作れるようになる。
テキトー教師DotAI 認定講師エコシステムを広げる意図が見えます。ただ、あくまで研究領域として位置づけられているので、すぐに実用的な検出サービスが出てくるかというと、そう単純ではないと思います。
室谷代表取締役検出の精度をめぐる議論は、しばらく続きそうですね。
画像・音声の来歴検証からテキストへ——OpenAIのコンテンツ来歴への取り組みの位置づけ
室谷代表取締役今回の発表を、OpenAIのコンテンツ来歴の取り組み全体の中で見るとどう位置づけられるんでしょう。
テキトー教師DotAI 認定講師OpenAIはすでに画像と音声について、自社モデルで生成されたかを確認するツールを公開しています。openai.com/verifyのウェブツールとContent Provenance APIですね。
室谷代表取締役それが今回、テキストにも広がる。ただし画像・音声のツールは引き続き公開で、テキストだけ承認研究者限定という非対称な形になっている。
テキトー教師DotAI 認定講師この非対称性が、テキスト透かしの難しさをそのまま表しているんですよ。画像や音声はピクセルや波形に信号を埋め込めるので比較的安定しますが、テキストは単語の選択という離散的なものに埋め込むので、扱いが難しい。
室谷代表取締役なるほど。で、OpenAIはこれを「ongoing area of research(継続的な研究領域)」として扱うと。
ユーザー、開発者、政策立案者、研究者からのフィードバックを受けながら改善を続けるとしています。
ユーザー、開発者、政策立案者、研究者からのフィードバックを受けながら改善を続けるとしています。
テキトー教師DotAI 認定講師規制対応と技術の成熟を同時に進めるという難しいバランスを取っているわけです。
室谷代表取締役業界全体でいうと、来歴の標準化の動きもありますし、規制と標準化が並行して進む中でのOpenAIの一手という見方ができますよね。
テキトー教師DotAI 認定講師そうですね。ただ、他社の具体的な動向については今回のソースでは触れられていないので、そこは現時点では明らかにされていないという扱いでいいと思います。
室谷代表取締役ですね。ソースにないことは書かない。
そこは徹底しましょう。
そこは徹底しましょう。
よくある質問
室谷代表取締役ここからは、読者からよく出そうな質問に答えていきますね。
テキトー教師DotAI 認定講師はい、いきましょう。
室谷代表取締役まず「透かしは自分で消せるのか」という疑問。これは公式に書き換えや翻訳で完全に消える可能性があると説明されています。
つまり、消すことは技術的に可能だということです。
つまり、消すことは技術的に可能だということです。
テキトー教師DotAI 認定講師ただし、それは透かしの検出を回避できるという意味でもあります。だからこそOpenAIも限界を明示しているわけです。
室谷代表取締役次に「プライバシーへの影響は」。これは透かしが個人・組織・アカウント・会話・プロンプトを特定しないと明記されています。
誰が書いたかは分からない。
誰が書いたかは分からない。
テキトー教師DotAI 認定講師そこは誤解されやすいので、しっかり押さえておきたいところです。透かしは「OpenAIのモデルで生成された可能性が高いか」だけを示すもので、個人を追跡するものではありません。
室谷代表取締役あと「APIを使っている場合はどうなるのか」。これは全世界で対象モデルの透かしを任意でオンにできる、デフォルトはオフ、というのが答えです。
テキトー教師DotAI 認定講師開発者としては、自分の用途に応じて選べるということですね。
室谷代表取締役「他社はどうしているのか」という比較の疑問もありますが、これは今回のソースでは触れられていないので、現時点では明らかにされていません。
テキトー教師DotAI 認定講師そこは憶測で埋めないようにしましょう。
室谷代表取締役最後に「今後の見通し」。OpenAIは継続的な研究領域として、ユーザーや開発者、政策立案者、研究者のフィードバックを受けながらテストと改善を続けるとしています。
textGrainの技術レポートの更新とオープンソース化も予定されています。
textGrainの技術レポートの更新とオープンソース化も予定されています。
テキトー教師DotAI 認定講師検出器の一般開放についても、今後の動向次第というところですね。
室谷代表取締役というわけで、今回はOpenAIのテキスト透かし導入の発表を、仕組みから限界、APIでの扱い、検出の現状まで見てきました。
テキトー教師DotAI 認定講師規制対応が技術の進歩を後押しする典型例ですが、同時に技術の限界も正直に認めている。その両面を理解しておくことが大事です。
室谷代表取締役そうですね。MYUUUでも引き続きウォッチしていきます。
AI関連の仕組みをもっと深く知りたい方は、ChatGPT長期記憶のすべてやChatGPTのコピペはバレる?あたりも合わせて読んでみてください。
AI関連の仕組みをもっと深く知りたい方は、ChatGPT長期記憶のすべてやChatGPTのコピペはバレる?あたりも合わせて読んでみてください。
テキトー教師DotAI 認定講師講座でもこうした最新動向は随時アップデートしていますので、受講生のみなさんはぜひキャッチアップしてくださいね。
