Private Safety Processing - OpenAIが中身を見ずに悪用を検知。ZDR契約のまま安全監視を続ける新方式 anchor left anchor right

Aug 20 2026 AIニュース

OpenAIが中身を見ずに悪用を検知。ZDR契約のまま安全監視を続ける新方式

anchor left anchor right

Private Safety Processing は、OpenAI が2026年8月19日にプレビュー公開した、データを保持しないまま悪用の兆候を検知するための安全監視の仕組みです。

📖 この記事で分かること

  • OpenAIがZDRと安全監視を両立させる新方式を発表
  • 中身を見せずに合図だけ送るPrivate Safety Processing
  • 対象は企業・API顧客、消費者向けプランは対象外
  • Anthropicは30日保持へ。二大ラボで答えが割れた

💡 知っておきたい用語

  • ZDR(Zero Data Retention): 送ったプロンプトとAIの応答を、処理が終わった時点で残さない取り決め。金庫に預けるのではなく、その場で受け取って持ち帰るイメージです
  • 安全シグナル: 中身そのものではなく「危ない兆候が出た」という合図だけを送る仕組み。健康診断で検査画像を渡さず、結果の数値だけを共有するのに近い形です

最終更新日: 2026年8月20日

▶ 公式ページ

Private Safety Processing - OpenAIが中身を見ずに悪用を検知。ZDR契約のまま安全監視を続ける新方式

OpenAIが発表した「中身を見ない安全監視」

この記事のポイント

  • OpenAIが2026年8月19日、フロンティアモデル向けZero Data Retention(ZDR)と「Private Safety Processing」のプレビューを発表(2026年8月時点)。
  • 担当者に中身を見せないまま、複数のやり取りにまたがる悪用パターンを検知する設計です。
  • 対象は条件を満たす企業・API顧客。本格展開と技術ホワイトペーパーは2026年9月予定。

OpenAIは2026年8月19日、フロンティアモデル向けにZero Data Retention(ZDR)を提供すると発表しました。同時に、ZDRを保ったまま悪用を検知する新しい仕組み「Private Safety Processing」(2026年8月時点)のプレビューも公表しています。

ZDRの内容自体は明快です。対象となるAPI顧客について、リクエストの処理が終わった後はプロンプトとモデルの応答を保持しません。顧客のコンテンツはOpenAIの担当者がレビューできず、企業顧客のデータは明示的にオプトインしない限りモデルの学習には使われません。

新しいのは、そこに監視を重ねた点です。詳細は上記の公式ページで公開されています。

なぜ「残さない」と「見張る」は両立しなかったのか

これまで、企業側の要求とAI提供側の要求は正面から衝突していました。

企業が求めるのは「中身を残さないこと」です。設計資料やソースコード、顧客情報をAPIに投げる以上、それがどこかに保存され、人間の目に触れる可能性は減らしたい。規制業種であればなおさらです。

一方、モデルを提供する側が求めるのは「見張れること」です。能力の高いモデルほど、危険な使われ方が1回のやり取りでは見えなくなります。OpenAIのHead of Product PolicyであるAleah Houze氏の説明として、リスクは時間をまたいだ複数のやり取りを見て初めて浮かぶものがある、と報じられています。例として挙げられているのは、あるやり取りでは企業のソフトウェアの弱点を尋ね、後のやり取りではリモートアクセスやセキュリティツールについて尋ねる、というパターンです。

個々の質問はどれも正当な業務上の問いに見えます。危険が見えるのはつなげて眺めたときだけで、そのためには記録が要る。ここが従来のトレードオフでした。

Private Safety Processingの仕組みと対象

OpenAIの答えは「中身は見ない。合図だけ受け取る」というものです。

仕組みとして公表されているのは次の点です。システムは関連する複数のやり取りにまたがるパターンを検出しますが、OpenAIの担当者に元の中身へのアクセスは与えません。OpenAI側に届くのは限定的に定義された安全シグナルだけで、プロンプトや応答そのものは露出しない設計とされています。

データの置き場所にも選択肢があります。顧客が管理するインフラ上に置いたままにする形か、OpenAI側に保存しつつ暗号鍵は顧客が管理する形かを選べます。鍵を持つのが顧客側であれば、保存されていても提供者は読めません。

提供状況は限定的です。現時点では初期顧客とのテスト段階で、本格的なロールアウトと技術ホワイトペーパーの公開は2026年9月を予定しています(2026年8月時点)。対象は条件を満たす企業・API顧客であり、ChatGPTの有料プランやサブスクリプションを使う消費者は対象ではありません。

一方で、公表されていない点も多く残ります。価格や追加料金の有無は不明です。レイテンシやスループットにどれだけのオーバーヘッドが乗るかも公表されていません。「フロンティアモデル」として具体的にどのモデルが対象になるか、eligibleな顧客の条件、提供リージョンと日本での扱い、正式提供の時期、安全シグナルの具体的な項目や誤検知が出たときの扱いも、いずれも現時点では明らかにされていません。

Anthropicは逆方向に動いた

同じ問題に対して、Anthropicは反対の答えを出しています。

Anthropicは対象モデル(Covered Models)について、プロンプトと出力を安全性の作業のために30日間保持する方針を取っており、これは2026年6月9日に発効しています。ZDR契約はFable 5およびMythosクラスのトラフィックには及びません。ZDR契約を結んでいる組織であっても、Fable 5を使うにはそのトラフィックについて明示的にデータ保持を有効にする必要があります。

理由として示されているのは、全顧客のデータを保持しなければ不正利用の検出や実運用からの学習が大きく損なわれ、保持はセキュリティ上必要である、という趣旨の説明です。

なおAnthropic側にもZDRに近い取り決めは残っています。一部のClaude PlatformおよびClaude Code for Enterpriseの顧客については、法令遵守や不正・危害への対処に必要な場合を除いて入出力を保存しない形が取られます。ただしその場合も、Usage Policyの執行のためにUser Safety分類器の結果は保持されます。

つまりAnthropicも「何も残さない」わけではなく、分類器の出力という形で痕跡を残しています。構図として見ると、両社とも「シグナルは要る」という点では一致しており、割れているのは元データを残すかどうかです。

編集部の見方

編集部は、今回の発表で企業にとって本当に効くのは「ZDRの提供」ではなく、ZDRを理由に最新モデルを諦めなくてよくなる可能性のほうだと見ています。

  • 根拠1: ZDR自体は目新しい概念ではありません。差分は、能力の高いフロンティアモデルに対してZDRを適用しながら安全監視も維持する道筋が示された点にあります。
  • 根拠2: Anthropicでは、ZDR契約を結んだ組織であってもFable 5を使うには明示的にデータ保持を有効にする必要があります。「契約上ZDRだから最新モデルは使えない」という詰まり方は、すでに実際に起きている制約です。
  • 根拠3: 鍵を顧客が管理する形が選べるため、調達や法務の審査で「提供者は技術的に読めない」と説明できます。契約上の約束だけの場合より通しやすくなります。

この見方が変わる条件は、9月に公開予定の技術ホワイトペーパーの中身です。安全シグナルとして何が送られるのかが具体的に示されないと、「中身は見ていない」がどこまで検証可能な主張なのかを判断できません。シグナルの粒度が細かすぎれば、実質的に内容を推定できてしまう懸念も残ります。

現時点での実務的な判断としては、規制業種でZDRを理由にAPI利用を見送っていた組織は、9月のホワイトペーパー公開を待って再評価する価値があります。逆に、価格やレイテンシへの影響が不明なまま前倒しで移行計画を組むのは早いと考えます。


よくある質問

Q: ZDRを使うと安全監視はまったく行われないのですか?

A: OpenAIのPrivate Safety Processingは、ZDRを保ったまま監視を行う設計とされています。担当者は中身を見ませんが、限定的に定義された安全シグナルはOpenAIに送られます。

Q: ChatGPTの有料プランを使っていますが対象になりますか?

A: 対象になりません。今回の対象は条件を満たす企業・API顧客であり、消費者向けの有料プランやサブスクリプションの利用者は含まれないとされています。

Q: いつから使えますか。料金はかかりますか?

A: 現時点では初期顧客とのテスト段階で、本格展開と技術ホワイトペーパーの公開は2026年9月予定です。価格や追加料金の有無、正式提供の時期は公表されていません。


まとめ

OpenAIは2026年8月19日、フロンティアモデル向けのZDR提供と、中身を見ずに悪用パターンを検知するPrivate Safety Processingのプレビューを発表しました。データを顧客側インフラに置くか、暗号鍵を顧客が管理する形かを選べます。同じ課題に対しAnthropicは対象モデルで30日保持を選んでおり、二大ラボの設計思想が分かれた形です。価格・レイテンシ・対象モデルの詳細は未公表で、判断材料は9月の技術ホワイトペーパーに持ち越されます。

OpenAIが監視の仕組みにどれだけの計算コストを割いているかは、以下の記事で詳しく解説しています:


【用語解説】

  • フロンティアモデル: 各社が提供する中で最も能力が高い最先端のモデル群を指す呼び方です。能力が高いぶん、悪用された場合の影響も大きくなります。
  • Covered Models: Anthropicが自社のデータ保持方針の対象として定義しているモデルの区分です。この区分に入るモデルは30日間の保持対象になります。
  • オプトイン: 利用者が明示的に同意した場合にだけ有効になる方式です。既定では無効で、同意しない限り適用されません。

引用元:


この記事について: AI 支援で執筆、編集部が事実確認・編集しています。誤りや追加情報があれば Contact よりお知らせください。

anchor left anchor right
KOJI TANEMURA

15 年以上の開発経験を持つソフトウェアエンジニア / テクノロジーライター。AI エージェントの実務活用を研究し、現場や経営者向けセミナーでその知見を発信。本メディア tech-noisy.com では、一次情報に基づく最新ニュース・解説記事を執筆。また、音楽生成 AI による DJ パフォーマンスを企業イベントで行うなど、テクノロジーと表現の融合も探求している。