OpenAIの文章透かし、検出結果だけで作者や真偽を決められない
OpenAIは2026年10月5日、EU AI Actの透明性要件への対応として、文章の単語選択に見えない統計的信号を埋め込む透かし方式と導入計画を公表しました。対象モデルのAPI利用者は世界各地で任意に有効化できますが、初期設定はオフです。ChatGPT・Codexへの導入はEUの対象出力から段階的に進める計画で、全世界の一律設定ではありません。透かし検出器は当初、審査済みの研究者・専門組織向けに限定されます。OpenAI自身も短い文章、編集、翻訳等で検出が難しくなり得るとし、透かしは作者、著作権、文章の正確さを証明しないと説明しています。検出・非検出だけで不正利用や人間執筆を断定せず、長さや編集状況、他の出所情報と合わせて扱う必要があります。
- AI生成文の出所を確かめたい人
- 学校・編集・採用でAI文章検出を扱う人
- 文章生成APIを提供する事業者
OpenAIの方式・評価は同社による技術説明です。検出・非検出だけで執筆者や不正利用を断定せず、法的・教育的判断には別の証拠と手続きを用いてください。
身近な事例を知る
文章検出ツールがAIらしいと判定し、提出者への対応を求められた
学校、編集部、採用担当などで文章検出結果を受け取り、AI利用の有無や作者について判断する場面です。
あなたならどうする?
まず一つ以上選んでから確認してみてください。
推奨される行動- 同社の透かし信号に関する限定的な結果として扱い、作者・人の貢献・正確性は別に確かめる
選んだカードの表示を見ながら、今回はどの行動が安心につながるか確認できます。
OpenAIの方式は、同社モデルの関与に関連する統計的信号を探します。文章の作者、編集割合、正確さ、他社モデルの利用までは示しません。教育・雇用上の判断には、本人への確認や作成記録など別の根拠が必要です。
確認ポイント
文章の単語選択へ見えない信号
OpenAIによると、textGrainはモデルが選ぶ単語に統計的信号を付加し、検出器がその信号の有無を評価します。これは画像メタデータや一般的なAI判定器と同一の技術ではありません。
APIは任意選択、初期状態オフ
対象モデルのAPI顧客は世界各地で透かしを任意に有効化できる一方、APIでは初期設定がオフです。API出力に必ず透かしがあると決めつけないでください。
ChatGPT・CodexはEUで段階導入予定
OpenAIは対象となるChatGPT・Codexの文章出力への透かしを、EU内で今後数週間かけて導入すると公表しました。全プラン・全地域で同時に既定オンになる発表ではありません。
検出器は初期段階で限定提供
文章透かし検出器への申請は研究者・専門組織向けに開かれましたが、アクセスは当初審査制です。OpenAIは誤検出と見逃しの両方があるため一般公開しないとしています。
検出は作者・責任・真偽を証明しない
OpenAIは透かしから人間の貢献度、所有権・責任、利用者の身元、文章の正確性は分からず、透かし非検出も人間執筆の証明ではないと列挙しています。
短文や編集で信号が弱まる
OpenAIの自社評価では、文章が短い場合や単語の置換・翻訳等の編集で検出率が低下する課題が示されています。数値は同社が選んだ英語データ等での評価であり、あらゆる文章や検出器の一般性能を示すものではありません。
EUの規則と実装コードを区別
欧州委員会はAI Act Article 50の透明性義務と、任意の実務規範を区別しています。OpenAIの方式は同社の対応計画であり、単独で法令要件全体や個別投稿者の義務を決定するものではありません。
現時点での見立て
短文・編集で検出が失敗する可能性があり、APIも既定オフ、ChatGPT/CodexはEUから段階導入です。検出器を懲戒や信用判断の唯一の根拠にしないでください。
安全な対処方法
安心につながる行動
- 検出結果には使用ツール、対象文章の長さ、編集・翻訳の有無を添えて記録する文章量や編集により透かしの検出可能性が変わるとOpenAIが説明しています。
- 検出器の結果だけで作者・不正・真実性を決めず、作成履歴や本人説明など別の根拠を確認する透かしは利用者や人間の寄与、内容の正確さを示しません。
- API提供者は対象モデル・有効化設定・地域・出力条件を確認するAPIは世界各地で任意設定できますが、初期状態はオフです。
- EU AI Actの義務、任意の実務規範、OpenAI固有の実装を区別する規制上の義務と一つの事業者の導入計画は同一ではありません。
- 教育・採用で使う場合は、検出器の限界と異議申立て・説明の手順を事前に定める誤検出・見逃しがあり得る判定を単独の不利益判断に使わないためです。
避けたい行動
- 透かし検出を文章の作者・著作権者・責任者の証明とするOpenAIはこれらを透かしでは確定できないと明記しています。
- 検出されなかった文章を人間が書いたと断定する短文、編集、翻訳、非対応モデル等では検出されない場合があります。
- 検出結果を文章が正確・安全・誤情報でないことの証明とみなす透かしは内容の真偽や文脈の適切さを検証しません。
- OpenAIの初期設定を、全API・全地域のChatGPT出力にも共通する設定と紹介するAPIの設定とEUのChatGPT/Codex導入は別の提供方法・段階です。
AIの前向きな活用
文章の出所情報を複数の手掛かりで読む
透かしがある場合もない場合も結論を限定し、作成記録・編集履歴・本人の説明・公開条件と組み合わせます。
- 教育機関が検出結果を懲戒の唯一根拠にしない
- 編集部が透かしを一つの来歴情報として扱う
- API事業者が出力方式とオプトイン状態を利用者に説明する
今回、覚えておきたいこと
AI文章の透かしは出所の限定的な信号。検出・非検出だけで作者や文章の真偽を断定しない。
情報源
- Our approach to EU text provenance rules(外部リンク) OpenAI 公式発表
- Code of Practice on Transparency of AI-generated Content(外部リンク) European Commission — Shaping Europe’s digital future 官公庁
誠主任からひとこと