Стремясь получить преимущество над конкурентом Anthropic, OpenAI объявила о новом ориентированном на конфиденциальность подходе к мониторингу злоупотреблений. Компания представила избранным клиентам предварительную версию сервиса Private Safety Processing. Это автоматизированная система, которая отслеживает потенциальные нарушения, одновременно не сохраняя данные клиентов. Подход OpenAI явно отличается от недавно объявленной политики Anthropic в отношении хранения данных.

Согласно этой политике, вызвавшей недовольство некоторых клиентов, AI-компания может хранить пользовательские данные — все сессии и содержащиеся в них разговоры — в течение 30 дней при работе с «покрываемыми моделями» (covered models). К ним относятся все модели класса Mythos и «будущие модели с аналогичными возможностями», уточняет Anthropic. Политика была объявлена в июле и предназначалась для повышения безопасности: она позволяет компании выявлять и анализировать потенциально неправомерное использование. Однако такой подход серьезно обеспокоил некоторые предприятия, работающие с большими объемами конфиденциальных данных и не желающие, чтобы AI-компания хранила или проверяла эту информацию.

OpenAI, как и большинство других AI-компаний, уже предоставляет клиентам сравнительно высокий уровень конфиденциальности благодаря политике Zero Data Retention (ZDR), запрещающей хранение данных. ZDR использует агентов внутри OpenAI API, которые отслеживают злоупотребления для каждой отдельной сессии. Благодаря этому данные клиентов не сохраняются компанией, но организации по-прежнему могут выявлять подозрительную активность без вмешательства человека. При этом Anthropic также в основном придерживается ZDR, за исключением работы с «покрываемыми моделями», такими как Fable.

В OpenAI заявляют, что Private Safety Processing — это новая технология, расширяющая возможности ZDR. Компания описывает ее как систему долгосрочного мониторинга безопасности, которая оценивает входные и выходные данные нескольких разговоров, а не только одной сессии. Мониторинг также выполняется агентом: если система срабатывает, он обнаруживает подозрительные взаимодействия и анализирует их между сессиями в поисках признаков потенциального злоупотребления. Представитель OpenAI сообщил TechCrunch, что новая технология помогает выявлять вредоносное использование ИИ, происходящее в рамках нескольких сессий.

Например, злоумышленник, который пытается разработать вредоносное ПО для кибератаки, может распределять запросы во времени, чтобы избежать обнаружения. Private Safety Processing способен анализировать такие разговоры и искать признаки злоупотребления без проверки пользовательских переписок человеком. Если система срабатывает, она может отправить OpenAI «узко определенный сигнал» с предупреждением о конкретном типе активности. На основании этого сигнала компания решает, «необходимо ли применение мер». В таком случае OpenAI свяжется с клиентом, чтобы получить дополнительный контекст или совместно разобраться в проблеме. При этом клиент сможет самостоятельно решить, передавать ли OpenAI свои данные, отметил представитель компании.

Anthropic, напротив, указывает, что проверка пользовательских данных людьми возможна, но только «через контролируемый канал доступа», в котором участвует «небольшая группа утвержденных проверяющих». Каждая такая сессия проверки «записывается в защищенный от подделки журнал, который проверяющие не могут отключить или изменить», заявляет компания. Корпоративное соперничество между OpenAI и Anthropic сейчас обострилось: обе компании ищут любую возможность получить преимущество друг над другом. Согласно недавнему отчету, показатели OpenAI за второй квартал росли медленнее, чем у Anthropic. Сообщается, что годовой темп выручки Anthropic достиг 65 млрд долларов. Инвесторы Anthropic заявляли, что компания может провести IPO при оценке в 2 трлн долларов, а OpenAI также работает над подготовкой к IPO.

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *