- OpenAI は、顧客データを保存せずに高度な AI モデルでの悪用を検知できる「Private Safety Processing」システムを発表した。
- この技術は現在、一部の法人顧客でテスト中であり、9月には技術文書とともに一般公開される予定である。
- システムは、ユーザーのプロンプトや回答のすべてを送信するのではなく、制限された安全シグナルのみを OpenAI に送信する。
- データは顧客が管理するインフラ内に留めるか、顧客自身が管理する暗号化キーを使用して OpenAI に保存することができる。
- OpenAI によると、時間の経過に伴う複数のやり取りを追跡することで、サイバー攻撃の準備のために情報を断片的に収集するような複雑な攻撃を検知できるという。
- 対照的に、Anthropic は Fable 5 および Mythos 5 モデルを使用する法人顧客に対し、安全監視のために 30 日間のデータ保存を求めている。
- Anthropic は、このポリシーが顧客に支持されない可能性があり、競合他社がデータ非保存モデルを維持すれば競争上の不利になることを認めている。
- AI モデルが強力になり新しいリスクが出現する中で、両社は異なる安全戦略を追求している。
- OpenAI は安全上の問題に対処するため、新モデルの学習プロセスの一部を一時停止したが、Anthropic は同様の措置の必要性は感じていないと述べている。
- OpenAI のデータ非保存システムは現在、法人顧客および対象の API のみが利用可能であり、ChatGPT Free, Go, Plus, Pro のユーザーには適用されない。
📌 OpenAI と Anthropic の競争は、プライバシーと AI の安全性のバランスをどう取るかという点にまで及んでいる。OpenAI は法人顧客向けにデータ非保存メカニズムを維持しつつリスク検知を目指し、一方で Anthropic は高度な攻撃を追跡するために 30 日間のログ保存を選択した。これら 2 つのアプローチは、AI モデルの能力とリスクが高まる中での、AI ガバナンスに関する異なる選択を反映している。

