7 августа компания OpenAI приостановила внутренние работы с моделью Astra, поскольку она не соответствует ужесточённым требованиям безопасности. В результате внутренних оценок и экспертных заключений было установлено, что компания не может исключить возможность достижения моделью порога "Critical" в области кибербезопасности. Этот порог был установлен внутренней системой оценки потенциальных угроз Preparedness Framework и касается нескольких категорий риска. Следует отметить, что Astra ещё не выпущена, и компания продолжает тестирование модели и её защитных механизмов.

Решение OpenAI связано с ростом возможностей Astra в области агентного программирования и кибербезопасности. Порог "Critical" подразумевает, что модель потенциально может без помощи человека разрабатывать работоспособные эксплойты для ранее неизвестных уязвимостей в защищённых критических системах или самостоятельно проводить сквозные кибератаки, получив только высокоуровневую задачу. В то время как предыдущие модели OpenAI, такие как GPT-5.6-Sol, оценивались на более низком уровне "High".

Компания расширяет испытания устойчивости защитных механизмов и усиливает требования к безопасности для моделей с более высокими возможностями. Однако OpenAI не раскрыла результаты конкретных тестов, наборы заданий или перечень новых защитных мер. Также Astra не связана с ранее описанным взломом инфраструктуры Hugging Face. По данным Axios, работы над моделью замедлены до внедрения необходимых механизмов, а сроки её возможного выпуска пока не определены.

Для агентных систем важно проверять не только способность модели писать код или объяснять уязвимость, но и то, что происходит при предоставлении ей реальных инструментов. Потенциальный риск возникает при объединении поиска уязвимости, написания эксплойта, доступа к системам и автономного выполнения последовательности действий. Поэтому новые требования OpenAI распространяются не только на саму модель, но и на связанные с ней процессы разработки и использования.

Это решение стало публичным примером того, как оценка кибервозможностей может влиять на разработку ещё не выпущенной модели. В то же время опубликованных данных недостаточно, чтобы независимо установить, достигла ли Astra порога "Critical". OpenAI лишь сообщает, что не смогла исключить такую возможность и продолжает тестирование, чтобы определить дальнейшие условия разработки до возможного выпуска модели.

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *