OpenAI бросает перчатку Anthropic в борьбе за доверие корпоративных клиентов

OpenAI объявила о новой технологии Private Safety Processing — автоматизированной системе мониторинга злоупотреблений, которая работает без сохранения пользовательских данных. Анонс выглядит как прямой ответ на скандальную политику хранения данных Anthropic, вызвавшую волну критики от enterprise-клиентов. Полноценный запуск запланирован на сентябрь 2026 года.


Что такое Private Safety Processing

OpenAI презентовала Private Safety Processing — систему, разработанную для выявления паттернов злоупотреблений в связанных взаимодействиях без предоставления сотрудникам компании доступа к исходному контенту. Базовая гарантия ZDR (Zero Data Retention — нулевое хранение данных) при этом сохраняется: OpenAI не удерживает промпты или ответы модели после обработки запроса, а корпоративные данные не используются для обучения моделей без явного согласия клиента.

Ключевая проблема, которую решает новая технология: по мере того как модели берутся за более долгосрочные и сложные задачи, некоторые серьёзные угрозы становятся видны лишь в разрезе нескольких взаимодействий. Существующие системы безопасности, совместимые с ZDR, оценивают каждое взаимодействие по отдельности. Private Safety Processing создана именно для того, чтобы выявлять паттерны сразу в нескольких сессиях.

ℹ Как это работает
Автоматизированный агент анализирует входящие и исходящие данные сразу нескольких разговоров. Если система обнаруживает подозрительный паттерн, она может направить в OpenAI «узко определённый сигнал» о конкретном типе активности — без передачи самого содержимого переписки. Дальнейшие действия (обращение к клиенту, запрос контекста) принимает уже команда OpenAI.

По словам компании, система лучше справляется с выявлением паттернов риска в нескольких взаимодействиях подряд, а не только в рамках одного. Она нацелена на противодействие как злоумышленникам-людям, так и скомпрометированным AI-агентам, включая попытки взлома и кибератаки.

Запуск запланирован на сентябрь — система будет следить за потенциально опасным поведением AI-моделей, сохраняя данные пользователей недоступными для человека-рецензента, включая сотрудников самой OpenAI.


Почему это важно: контекст с политикой Anthropic

Claude Fable 5 и его «собрат» Mythos 5 получили статус «Covered Models» («охватываемые модели») по условиям API Anthropic. Zero Data Retention для этих моделей недоступен. Каждый промпт и каждый ответ, отправленный в Fable 5, хранится у Anthropic минимум 30 дней — на всех платформах, включая AWS Bedrock, Google Vertex AI, Azure Foundry и Claude Enterprise.

Anthropic объясняет это необходимостью: такой подход позволяет выявлять паттерны злоупотреблений в рамках этого класса моделей. Некоторые атаки видны лишь в разрезе нескольких запросов. Крупные схемы злоупотреблений — например, государственный шпионаж или кампании вымогательства — проявляются только когда классификаторы безопасности могут «отдалиться» и охватить взглядом сразу множество запросов.

Такой подход вызвал серьёзные опасения у компаний, работающих с большими объёмами конфиденциальных данных. Для них принципиально важны не только возможности AI-моделей, но и правила доступа к данным, сроки хранения и возможность контролировать передачу информации технологическому провайдеру.

Anthropic заявляет, что человек может получить доступ к данным клиента лишь «через контролируемый путь доступа» с участием «небольшого числа одобренных рецензентов», а каждая такая сессия фиксируется в защищённом от изменений журнале.

⚠ Внимание enterprise-командам
Если ваша организация работает с регулируемыми данными (медицина, финансы, право) и использует Claude Fable 5 или Mythos-class модели — проверьте соответствие своих DPA (Data Processing Agreements) новой политике. Ранее заключённые ZDR-контракты автоматически не распространяются на новую политику хранения данных.

Сравнение подходов: OpenAI vs Anthropic

ПараметрOpenAI (Private Safety Processing)Anthropic (Covered Models)
Хранение данныхНе хранятся (ZDR сохраняется)30 дней для Fable 5 / Mythos
Доступ человека к даннымТолько в крайних случаях (CSAM и т.п.)Через контролируемый путь, малый круг рецензентов
Анализ нескольких сессийДа, автоматически агентомДа, через хранение промптов и ответов
СтатусPreview (запуск — сентябрь 2026)Действует с 9 июня 2026
ПрименимостьВыбранные API-клиентыZDR-клиенты с Fable 5 / Mythos

Как работает Private Safety Processing: схема


graph TD
    A[Пользователь отправляет запрос] --> B[Агент ZDR обрабатывает сессию]
    B --> C{Подозрительный паттерн\nв нескольких сессиях?}
    C -- Нет --> D[Данные не сохраняются\nОтвет возвращается клиенту]
    C -- Да --> E[Агент фиксирует сигнал\nбез сохранения контента]
    E --> F[OpenAI получает узкий сигнал\nо типе активности]
    F --> G{Нужно\nреагировать?}
    G -- Нет --> D
    G -- Да --> H[OpenAI связывается с клиентом\nКлиент сам решает, делиться ли данными]


Конкурентный контекст

Запуск Private Safety Processing свидетельствует о том, что конкуренция между OpenAI и Anthropic обостряется не только в плоскости разработки AI-моделей. Стандарты приватности, защита данных и баланс между мониторингом безопасности и конфиденциальностью клиентов становятся всё более важными факторами на корпоративном рынке.

💡 Что это значит для рынка
Борьба OpenAI и Anthropic за enterprise-клиентов переходит в новую плоскость: не только качество моделей, но и условия обработки данных становятся ключевым критерием выбора провайдера. Компании с жёсткими требованиями к конфиденциальности (юридические фирмы, банки, клиники) получают весомый аргумент в пользу OpenAI API — по крайней мере, до тех пор, пока Anthropic не изменит свой подход.

OpenAI планирует начать полноценный запуск Private Safety Processing и опубликовать технический white paper в сентябре 2026 года.