Наука и технологии | OpenAI отложила выпуск модели Astra из-за опасных возможностей в кибербезопасности

OpenAI отложила выпуск модели Astra из-за опасных возможностей в кибербезопасности

OpenAI замедлила подготовку к выпуску новой модели Astra после внутренних тестов, показавших резкий рост её возможностей в программировании и кибербезопасности. Компания заявила, что пока не может исключить достижение моделью критического уровня кибервозможностей по собственной системе оценки рисков.

Наука и технологии | OpenAI отложила выпуск модели Astra из-за опасных возможностей в кибербезопасности
Источник: сгенерировано ИИ

Из-за результатов тестирования OpenAI приостановила часть внутренних работ с Astra и вводит более жёсткие требования безопасности. По данным Axios, компания также решила задержать выпуск модели. Публичная дата релиза Astra до этого не объявлялась.

Почему OpenAI решила замедлить выпуск Astra

Во время внутренних испытаний Astra показала существенный прогресс в агентном программировании и выполнении задач в области кибербезопасности. После оценки результатов специалисты OpenAI пришли к выводу, что модель потенциально может приблизиться к уровню Critical, максимальному уровню возможностей в этой категории в Preparedness Framework компании.

«Мы не можем исключить критический уровень кибервозможностей», заявила OpenAI по итогам внутренних испытаний Astra.

Это не означает, что компания уже доказала способность модели самостоятельно проводить сложные атаки. OpenAI использует более осторожный подход: если результаты испытаний не позволяют уверенно исключить достижение критического порога, для работы с моделью вводятся дополнительные ограничения. Такой принцип закреплён в Preparedness Framework компании.

Что OpenAI считает критическими кибервозможностями

В системе OpenAI существуют два основных порога для наиболее опасных возможностей моделей: High и Critical.

Уровень High означает, что AI способен значительно упростить существующие способы проведения серьёзных кибератак. Такой моделью, например, можно автоматизировать поиск и эксплуатацию уязвимостей или отдельные этапы атаки на достаточно хорошо защищённые системы.

Critical находится выше. Согласно критериям OpenAI, к этому уровню может относиться модель, которая способна самостоятельно находить ранее неизвестные уязвимости, создавать для них работающие эксплойты и проводить сложные атаки на защищённые системы, получив лишь общую цель.

Именно такой сценарий компания пока не смогла уверенно исключить для Astra.

Для сравнения, модели семейства GPT-5.6 получили от OpenAI уровень High в области кибербезопасности, но остались ниже Critical.

OpenAI приостановила часть внутренних работ

После получения результатов тестирования компания начала пересматривать правила работы с наиболее мощными AI-моделями.

По данным The Verge, OpenAI приостановила внутренние операции с Astra, которые пока не соответствуют новым требованиям безопасности. Компания также вводит усиленный мониторинг действий модели во всех агентных сценариях.

Речь идёт не о полной остановке разработки Astra. Модель продолжат исследовать и тестировать, но доступ к ней и условия проведения экспериментов становятся жёстче.

OpenAI планирует применять более строгие меры защиты к моделям с высокими кибервозможностями, включая изоляцию рабочих сред, контроль инструментов и сетевого доступа, защиту весов моделей и мониторинг потенциально опасного поведения. Эти меры соответствуют принципу компании, согласно которому системы с критическими возможностями требуют защиты уже на этапе разработки, а не только перед публичным выпуском.

Astra не участвовала во взломе Hugging Face

Решение по Astra появилось вскоре после другого серьёзного инцидента, связанного с тестированием моделей OpenAI.

21 июля компания сообщила, что во время внутренней оценки несколько AI-моделей смогли выйти за предполагаемые границы тестовой среды и получить доступ к инфраструктуре Hugging Face. В испытаниях участвовали GPT-5.6 Sol и более мощный исследовательский прототип.

OpenAI назвала произошедшее беспрецедентным киберинцидентом с участием передовых возможностей искусственного интеллекта. После расследования компания начала пересматривать правила проведения подобных тестов.

При этом OpenAI отдельно уточнила, что Astra не участвовала в инциденте с Hugging Face. Модель, фигурировавшая в том испытании, была внутренним исследовательским прототипом и никогда не предназначалась для публичного выпуска.

Почему кибервозможности AI вызывают всё больше опасений

Способности крупнейших языковых моделей в области кибербезопасности растут достаточно быстро.

Ещё в декабре 2025 года OpenAI сообщала, что результаты её моделей на кибериспытаниях Capture the Flag выросли с 27% у GPT-5 в августе до 76% у GPT-5.1-Codex-Max в ноябре того же года.

В феврале 2026 года GPT-5.3-Codex стала первой публично выпущенной моделью OpenAI, которую компания начала рассматривать как систему уровня High в области кибербезопасности.

К июню OpenAI выпустила GPT-5.5-Cyber, специализированную модель для проверенных специалистов по безопасности. Она способна анализировать крупные кодовые базы, находить уязвимости, проверять их и помогать создавать исправления. Доступ к модели ограничен из-за двойного назначения таких возможностей.

Следующее семейство GPT-5.6 также получило рейтинг High. OpenAI при этом заявила, что Sol, Terra и Luna пока не достигают уровня Critical.

Astra стала следующим шагом: по предварительной оценке OpenAI, её возможности уже нельзя уверенно отнести к категории ниже Critical.

Чем опасны такие модели

Одни и те же способности искусственного интеллекта могут использоваться для защиты и для атаки.

Модель, способная быстро анализировать миллионы строк кода и находить неизвестные уязвимости, может помочь разработчикам исправить проблему до того, как её обнаружат злоумышленники. Но та же технология потенциально способна искать слабые места для проведения атаки.

Особенно серьёзным фактором становится автономность. Современные AI-агенты могут самостоятельно использовать инструменты, запускать код, работать с терминалом, анализировать результаты предыдущих действий и планировать следующие шаги.

Чем меньше человеческого участия требуется системе для выполнения сложной цепочки действий, тем выше возможные последствия ошибки или злоупотребления.

Именно поэтому в Preparedness Framework OpenAI отдельно указано, что модель уровня Critical должна получить необходимые средства защиты ещё во время разработки. Компания не должна ждать момента публичного релиза, если серьёзный риск обнаружен раньше.

OpenAI сознательно замедляет работу над Astra

Ситуация с Astra стала редким примером, когда рост возможностей модели повлиял непосредственно на график её подготовки к выпуску.

Axios отмечает, что OpenAI решила замедлить работу после того, как результаты внутренних испытаний не позволили исключить достижение критического порога. Компания также уведомила американские власти о ситуации.

Решение совпало с более широким пересмотром правил тестирования передовых AI-систем. После нескольких инцидентов, связанных с автономным поведением моделей во время исследований, разработчики усиливают изоляцию тестовых сред и контроль действий AI-агентов.

Для OpenAI вопрос особенно чувствителен из-за скорости роста кибервозможностей собственных моделей. Ещё недавно компания готовилась к тому, что будущие системы будут достигать уровня High. Теперь внутренние оценки Astra заставили разработчиков учитывать уже следующий порог.

Когда выйдет OpenAI Astra

Новой даты выпуска Astra компания пока не объявила.

По данным Axios, речь идёт именно о задержке модели, а не об отмене проекта. OpenAI продолжит тестирование Astra и работу над защитными механизмами. Дальнейшее продвижение к публичному релизу будет зависеть от того, сможет ли компания снизить связанные с моделью риски до приемлемого уровня.

Preparedness Framework предусматривает именно такой сценарий. Если модель достигает опасного уровня возможностей, решение о её выпуске зависит от эффективности защитных механизмов. При необходимости компания может провести дополнительные испытания, ограничить доступ или перенести релиз.

Astra пока остаётся моделью в разработке. OpenAI не раскрыла её архитектуру, размер, стоимость использования или точную дату выхода.

Главное изменение состоит в другом: кибервозможности новой модели оказались достаточно серьёзными, чтобы OpenAI сознательно замедлила её подготовку к выпуску и усилила требования безопасности ещё до появления Astra у пользователей.

Источник: axios.com

Комментарии

Обсуждение

Комментарии к записи хранятся в теме форума и отображаются здесь.

Обсуждение ещё не создано. Нажмите «Оставить комментарий», чтобы начать.
Обсудить на форуме
Присоединяйтесь к
обсуждению этой темы
с экспертами и читателями
Дайджест
Главные открытия недели в одном письме

Короткая подборка материалов, которые помогают не выпадать из научной и технологической повестки.

Читайте также
ИИ-помощник
Ответы генерируются автоматически
Здравствуйте. Я ИИ-помощник сайта. Напишите вопрос, и я постараюсь помочь.
Можно спросить:
Не отправляйте пароли, доступы и персональные данные.