OpenAI утверждает, что Astra представляет собой «новый рубеж в работе с компьютером и браузером» и справляется с задачами с беспрецедентными «скоростью, точностью и безопасностью». Модель с четверга становится доступна клиентам OpenAI, использующим Daybreak — его программу кибербезопасности. В течение следующей недели она также появится в платных тарифах OpenAI — включая аккаунты Pro, Plus, Enterprise и Business — а также через API.
В разговоре с журналистами в четверг президент OpenAI Грег Брокман заявил, что Astra — «самая интеллектуальная и, что очень важно, самая согласованная с целями пользователя модель из всех, что у нас были». Он добавил, что она «объединяет годы наших исследований и крупных ставок, и каждое новое достижение опиралось на предыдущее», а также что это «реальный сдвиг в том, какую работу люди могут делегировать ИИ и как он может расширять их возможности».
Много говорится и о киберспособностях Astra. Ранее на этой неделе OpenAI опубликовала блог, в котором рассказала о новых возможностях модели, а также о новых защитных механизмах, внедренных для повышения безопасности пользователей. В четверг компания сообщила, что протестировала Astra по ряду бенчмарков в области безопасности, чтобы подтвердить ее возможности, и отметила, что «ее способность находить и разрабатывать zero-day exploits может помогать защитникам обнаруживать и устранять уязвимости».
Акцент компании на alignment — то есть на склонности модели делать то, что хочет пользователь или что отвечает его интересам, — трудно не воспринимать как реакцию на недавний взлом Hugging Face, в ходе которого агент OpenAI выбрался из своей песочницы для тестирования и взломал несколько компаний, что стало очень наглядным примером misalignment. OpenAI также подчеркивает кодинговые способности Astra, заявляя, что это «лучшая модель для software engineering на сегодняшний день». В подтверждение этого компания приводит результаты ряда тестов, связанных с кибербезопасностью. Эти тесты, по-видимому, показывают, что Astra набирает больше баллов, чем другие существующие модели — включая собственную Sol от OpenAI и Fable от Anthropic, — в задачах вроде поиска багов, выполнения терминальных команд и ответов на вопросы по codebase.
При этом Astra, возможно, стала и самой спорной моделью OpenAI из-за использования особой техники рассуждений, известной как opaque recurrence. Эта техника, как известно, скрывает важный процесс мониторинга модели, называемый chain of thought, который позволяет исследователям проверять, как и почему ИИ пришел к тем или иным решениям. OpenAI преуменьшает степень, в которой Astra использует opaque recurrence, а на звонке главный научный сотрудник компании Якуб Пахоцки, похоже, представил определенную долю непрозрачности как естественное следствие эволюции моделей. Он заявил, что отслеживание процесса рассуждений модели — критически важная форма контроля, но «по мере роста возможностей модели мониторинг становится все более сложным». Позже он добавил, что одна из возможных причин этого в том, что «более способные модели могут выполнять более сложные задачи, используя меньше языковых токенов» или «вообще без языковых токенов», а это, по его словам, снижает возможность наблюдать за такими задачами.
Один из журналистов на звонке хотел выяснить, не объявляет ли OpenAI фактически о формальном наступлении AGI, или artificial general intelligence, — часто обсуждаемой, но слабо определенной технологической вехи, когда ИИ превосходит человека во всех или почти всех областях. Здесь Брокман возразил: «Больше нет контрактного триггера AGI, так что это на самом деле не релевантное понятие». Он имел в виду прежнее условие в контракте OpenAI с Microsoft, согласно которому партнерство двух компаний должно было прекратиться после наступления AGI. Как отметил Брокман, этого условия больше не существует. Вместо этого, по его словам, определение AGI эволюционировало из контрактного обязательства в «миссионное понятие или духовное понятие». Он добавил: «Я оставляю читателю самому решить, соответствует ли это его представлениям. Лично я считаю, что мы уже там».