The Decoder

OpenAIはEUにおいてChatGPTのテキストに透かしを入れますが、世界中のAPIユーザーに対してはオプション扱いとします

OpenAIはEUにおいてChatGPTに不可視のTextGrainウォーターマークを追加するが、Anthropicとは異なり、世界中のAPI顧客はこれをオプトアウトできる。テストでは検出率は最大95パーセントに達するが、単語の4分の1が置き換えられると17パーセントまで低下する。本記事「OpenAI will watermark ChatGPT text in the EU but makes it optional for API…

Matthias Bastian
画像の出典 · The Decoder

OpenAIはEU圏でChatGPTのテキストにウォーターマークを付与するが、世界中のAPI利用者については任意とする

Matthias Bastian Matthias Bastian Matthias BastianのLinkedInプロフィールを見る 2026年10月5日 Image description THE DECODERによるプロンプトで生成されたGPT-Image-2

OpenAIはEU規制に準拠するため、ChatGPTのテキストに不可視の透かしを追加しています。Anthropicとは異なり、世界中のAPI利用者が透かしをオフにできるようにする予定です。

報道によれば、EU AI法はAIプロバイダーに対し、生成テキストを機械可読な形式でラベル表示することを義務付けている。OpenAIの答えがtextGrainだ。これはモデルの単語選択に目に見えない統計的シグナルを埋め込む技術である。その仕組みは、 ClaudeのSynthIDウォーターマーク、これは〜を使用するものだが、 Googleのオープンソース技術.

OpenAIは、今後数週間にわたりEU(欧州連合)のChatGPTおよびCodexユーザー向けにウォーターマーク機能を有効にすると発表した。APIのウォーターマークは全世界でオプトイン方式となるが、それとは異なり AnthropicによるClaudeへの義務的なウォーターマーク導入ユーザーがどのようにモデルへアクセスした場合でも、世界的に適用されるものです。OpenAIのAPIウォーターマーキングは、今後数週間以内にMicrosoft Azureなどのクラウドパートナーを通じても利用可能になる予定です。

テキストの編集で検出率が大幅に低下

OpenAIは、内部テストにおいてtextGrainがGoogleのテキスト向けSynthIDを含む他の手法と同等かそれ以上の性能を示したと述べています。同社はまた、他の人がその上に構築できるよう、この技術をオープンソースとして公開する計画です。Ad

検出率はテキストの長さや題材に大きく左右されます。検出器を偽陽性率1パーセントのターゲットに設定した場合、心理学に関する400トークンの文章では約95パーセントでウォーターマークを識別しました。200トークンでは約80パーセントまで低下しました。

OpenAIによると、数学コンテンツでは検出率が「大幅に低く」、これはモデルが語彙を選ぶ自由度が低いためです。長い文章では統計的シグナルが強まり、検出精度が向上する可能性がありますが、結果は依然としてコンテンツに依存する可能性があります。OpenAIはその仮定を検証するためのデータを提供していません。

検出精度はテキストの長さや主題に大きく左右されます。400トークン(およそ300語)では、この検出器は心理学の文章では約94パーセントのウォーターマークを識別しますが、数学の文章では約60パーセントしか識別できません。 | 画像: OpenAI

テキストを編集すると、ウォーターマークの検出も難しくなります。OpenAIによれば、わずか10パーセントの単語を類義語に置き換えるだけで、400トークンの文章に対する検出率は約92パーセントから66パーセントに低下します。4分の1の単語を置き換えると検出率は17パーセントに落ち、ウォーターマークは容易にかわされてしまいます。この弱点はOpenAIに有利に働く可能性があります。自分のChatGPT利用を検出されたくないユーザーは、そのウォーターマークが除去しにくいものになれば、オープンウェイトのモデルに乗り換えるかもしれません。

わずかな編集でも検出率は大幅に低下します。25パーセントの単語を置き換えるだけで、400トークンの文章であっても検出率は20パーセントを下回ります。 | 画像: OpenAI

A 技術レポート textGrainの仕組みを詳しく解説している。AnthropicはClaudeのウォーターマークの検出率を公表していないが、同社のシステムは編集に対してもよく耐えると述べている。Ad

OpenAIは、ウォーターマーキングが出力品質を損なわないと述べ、自社のフロンティアモデルAstraのテスト結果を根拠に挙げています。同社によると、GPQA Diamond、BrowseComp、DeepSWEを含む8つのベンチマークにおいて、ウォーターマーキングのオン・オフによる顕著な性能差は見られなかったとしています。ただし、これらの結果は、ウォーターマーキングが文章の品質に影響を与えるかどうかを証明するものではなく、その点については 批評家たちはまた、Claudeのウォーターマークについても疑問を呈している。.

OpenAIはまた、検出されたウォーターマークはテキストにどれほど人間の創造性や編集が加わったかについては何も明らかにしないとも述べています。ウォーターマークは所有権を確立したり、責任を割り当てたり、ユーザーを特定したり、テキストが正確かどうかを示したりするものではなく、ウォーターマークが検出されないこともまた、テキストが人間によって書かれた証明にはなりません。文章が短すぎる場合や、編集・翻訳されている場合、あるいは検出器が対応していないモデルから生成された場合もあります。

OpenAIは当面、検出ツールへのアクセスを制限する予定です

当初、textGrainの検出ツールへのアクセスは、選ばれた研究者や専門機関にのみ提供されます。彼らは申請を通じてアクセスできます。 申込書。OpenAIはEUの 行動規範。Anthropicも同様の 検出APIによるアプローチ.

このツールはOpenAIのウォーターマークを検出したかどうかのみを報告します。ユーザーを特定したり、プロンプトや会話内容を明らかにしたりすることはありません。

OpenAIは、この検出ツールが watermark を外したテキストを検出したり、逆に watermark を見逃したりする可能性があるため、アクセスを制限していると述べています。同社は「結果を責任を持って解釈できると判断した場合」にアクセスを拡大する計画です。それがいつになるかについては言及していません。

画像および音声向けの既存の検証ツールは、引き続き一般に公開されており、以下が含まれます。 openai.com/verify 「and the」 コンテンツ来歴 API.

誇張なしのAIニュース – 人間がキュレーション

広告のない読書、週刊のAIニュースレター、年6回の限定「AI Radar」フロンティアレポート、全アーカイブへのアクセス、そしてコメント欄へのアクセスのために、THE DECODERを購読してください。

出典: OpenAI
原文の出典

The Decoder

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください