OpenAI готовит к выпуску Astra — свою первую модель с «критическими» возможностями в кибербезопасности
Компания OpenAI готовится выпустить новую модель искусственного интеллекта под названием Astra. Разработчик утверждает, что она значительно превосходит нынешние системы компании в ряде задач и стала первой моделью OpenAI, достигшей «критического» уровня возможностей в сфере кибербезопасности.
Об этом компания сообщила 1 сентября. Точная дата запуска пока не называется: OpenAI заявляет, что планирует предоставить доступ к Astra «вскоре». При этом наиболее продвинутые возможности модели в области кибербезопасности первоначально будут доступны лишь ограниченному кругу специалистов.
Почему Astra привлекла внимание
Главная особенность Astra — возможности модели при работе с программным кодом и поиском уязвимостей компьютерных систем.
Согласно оценке OpenAI, при наличии соответствующих инструментов и доступа Astra способна самостоятельно обнаруживать ранее неизвестные уязвимости и находить способы их эксплуатации в хорошо защищенных компьютерных системах без необходимости получать от человека пошаговые инструкции.
Именно поэтому компания впервые присвоила своей модели уровень Critical — «критический» — в категории кибербезопасности в рамках собственной Preparedness Framework, которая используется OpenAI для оценки потенциальных рисков наиболее мощных моделей.
Еще в августе разработчик сообщал, что предварительные испытания Astra показали существенный прогресс в программировании и кибербезопасности. После этого OpenAI усилила меры безопасности и приостановила часть работ с моделью, пока соответствующая инфраструктура не была переведена на более высокий уровень защиты.
Astra превзошла GPT-5.6
По данным OpenAI, в тестах по кибербезопасности Astra продемонстрировала значительно более высокие результаты, чем GPT-5.6 Sol.
В частности, модель получила максимальные 100% в ExploitBench — тесте, оценивающем способность искусственного интеллекта работать с известными уязвимостями.
Компания также разработала внутренний вариант теста с 20 недавно обнаруженными серьезными уязвимостями движка V8. Во время этих испытаний Astra, по утверждению OpenAI, обнаружила две ранее неизвестные уязвимости нулевого дня. Компания заявила, что передает информацию о них разработчикам соответствующего программного обеспечения.
При этом OpenAI подчеркивает, что такие результаты были получены при предоставлении Astra специальных инструментов через систему Daybreak Blue и не отражают возможности модели в обычном пользовательском режиме.
Выпуск модели пришлось замедлить
Еще 7 августа OpenAI объявила об усилении мер безопасности вокруг Astra после того, как внутренние тесты показали, что модель может приблизиться к критическому уровню кибервозможностей.
Компания ввела дополнительные ограничения на доступ к инструментам и сетям, усилила защиту параметров модели и мониторинг ее действий. Часть внутренних процессов, связанных с Astra, была временно приостановлена до внедрения новых требований безопасности.
18 августа OpenAI сообщила, что значительная часть соответствующих рабочих процессов по-прежнему оставалась приостановленной до их переноса в более защищенную инфраструктуру.
Теперь компания заявляет, что дополнительные испытания подтвердили достижение Astra критического порога, но одновременно показали достаточную эффективность разработанных мер защиты для подготовки модели к выпуску.
Самые мощные функции получат не все
OpenAI решила не предоставлять наиболее продвинутые кибервозможности Astra всем пользователям сразу.
Сначала доступ к ним получит небольшая группа тестировщиков. В дальнейшем компания намерена расширять доступ через программу Daybreak Blue, ориентированную прежде всего на специалистов, занимающихся защитой компьютерных систем.
Для предотвращения злоупотреблений OpenAI также усилила способность модели отказываться от потенциально опасных запросов.
По данным компании, в специальных тестах Astra отклоняла 91,5% запросов, связанных с попытками обойти ограничения в сфере кибербезопасности. Для сравнения, у GPT-5.6 Sol этот показатель составлял 59%.
Разработчик предупреждает, что на первоначальном этапе такие ограничения могут оказаться чрезмерно строгими и иногда мешать выполнению легитимных задач.
Модель проверяли с участием властей США
Перед запланированным выпуском Astra также прошла добровольную проверку с участием правительства США.
Как сообщает Axios, глава OpenAI Сэм Альтман назвал взаимодействие с государственными структурами продуктивным и выступил за сотрудничество между разработчиками наиболее мощных систем искусственного интеллекта и государственными регуляторами.
Американская система добровольной оценки передовых AI-моделей может предусматривать предоставление чиновникам доступа к ним на срок до 30 дней.
При этом OpenAI пока не раскрывает все подробности тестирования Astra. Более полную информацию о возможностях, ограничениях и результатах проверки безопасности компания обещает представить в системной карточке одновременно с выпуском модели.
Таким образом, Astra может стать важным этапом в развитии моделей OpenAI. Впервые компания готовится вывести на рынок систему, которую сама относит к критическому уровню возможностей в одной из категорий риска. Одновременно ее запуск становится тестом нового подхода: чем мощнее становятся AI-модели, тем больше ограничений и дополнительных мер безопасности разработчикам приходится внедрять перед их публичным выпуском.
OpenAI готовит к выпуску Astra — свою первую модель с «критическими» возможностями в кибербезопасности
Тайвань планирует выплатить каждому жителю по $314 на фоне рекордного роста экономики