- OpenAI 推出了“私人安全处理”(Private Safety Processing)系统,旨在不存储客户数据的情况下检测先进 AI 模型中的违规行为。
- 该技术目前正由部分企业客户进行测试,计划于 9 月公开发布并提供技术文档。
- 系统仅向 OpenAI 发送有限的安全信号,而非传输完整的用户指令或回复。
- 数据可以保留在客户控制的基础设施中,或由 OpenAI 使用客户自管的加密密钥进行存储。
- OpenAI 表示,通过跨时间跟踪多个交互会话,有助于检测复杂的攻击,例如用户收集零散信息以筹备网络攻击。
- 与此形成对比的是,Anthropic 要求使用 Fable 5 和 Mythos 5 模型的多企业客户必须接受 30 天的数据留存,以便进行安全监控。
- Anthropic 承认,这一政策可能得不到客户的支持,如果竞争对手维持不留存数据的模式,这将造成竞争劣势。
- 随着 AI 模型能力的增强和新风险的出现,两家公司正在追求两种不同的安全策略。
- OpenAI 最近还暂停了部分新模型的训练以解决安全问题,而 Anthropic 表示尚未发现需要采取类似措施。
- OpenAI 的零数据留存系统目前仅限企业客户和符合条件的 API 使用,尚未应用于 ChatGPT Free、Go、Plus 或 Pro 用户。
📌 OpenAI 与 Anthropic 之间的竞争正扩展到如何平衡隐私与 AI 安全。OpenAI 倾向于在为企业客户维持不留存数据机制的同时检测风险,而 Anthropic 则选择保留 30 天日志以追踪复杂攻击。这两种方法反映了在 AI 模型能力和风险日益增长的背景下,企业对 AI 治理的不同选择。
