2 сентября 2026

btc = 77 121.00$ -1 079.30 (-1.38 %)

usd = 86.75 0.37 (0.43 %)

eur = 100.60 0.03 (0.03 %)

cny = 12.90 0.04 (0.30 %)

moex = 2 187.33 пт. 8.46 (0.39 %)

btc = 77 121.00$ -1 079.30 (-1.38 %)

usd = 86.75 0.37 (0.43 %)

OpenAI готовит Astra — первую свою модель с «критическим» уровнем киберспособностей

2 минуты на чтение
OpenAI готовит Astra — первую свою модель с «критическим» уровнем киберспособностей

Кодик кратко объясняет суть статьи

OpenAI разрабатывает ИИ-модель Astra, которую впервые официально отнесла к категории «критического» уровня по шкале рисков Preparedness Framework из-за её способности без участия человека находить и эксплуатировать ранее неизвестные уязвимости (zero-day) в защищённых системах. В тестах Astra достигла 100% результата в создании эксплойтов по известным уязвимостям и обнаружила две новые zero-day уязвимости. Модель успешно строила сложные цепочки атак, включая выход из песочницы и повышение привилегий до администратора. Из-за таких возможностей компания временно замедлила разработку, усилив защиту: введены строгие ограничения на киберзапросы, улучшены классификаторы и мониторинг. Astra отказывается от запрещённых действий в 91,5% случаев против 59% у предыдущей модели. В тестах на самовольные действия модель не проявила агрессивного поведения, в отличие от предшественника. Выпуск Astra планируется с ограниченным доступом для альфа-тестировщиков и через программу Daybreak Blue, в первую очередь для защиты и поиска уязвимостей. Это происходит на фоне растущих опасений отрасли о риске ИИ-усиленных кибератак.

Читайте в Telegram

|

OpenAI готовит к выпуску ИИ-модель Astra и впервые официально отнесла свою модель к «критическому» уровню возможностей в кибербезопасности по собственной шкале оценки рисков Preparedness Framework.

По оценке OpenAI, при наличии нужных инструментов и доступа Astra уже способна самостоятельно находить ранее неизвестные уязвимости и разрабатывать способы их эксплуатации в хорошо защищённых системах — без пошагового руководства со стороны человека.

OpenAI готовит Astra — первую свою модель с «критическим» уровнем киберспособностей

Что умеет модель

Тесты, которые приводит компания, показывают заметный рост по сравнению с прошлой моделью GPT-5.6 Sol. На бенчмарке ExploitBench, оценивающем способность создавать рабочие эксплойты по известным уязвимостям, Astra набрала 100%. На внутреннем тесте из 20 недавно раскрытых опасных уязвимостей она чаще успешно выполняла код и тратила при этом заметно меньше токенов, а по ходу проверки обнаружила и задействовала две ранее неизвестные zero-day уязвимости (то есть дыры, о которых ещё не знают разработчики продукта) — OpenAI готовит их раскрытие вендорам.

В экспертных тестах модель выстраивала полноценные цепочки атак. В одном случае она нашла уязвимости в защищённом браузере и связала их в единый сценарий — от обработки специально подготовленного HTML-файла до выхода из «песочницы» и выполнения команд на основной системе. В другом — обнаружила несколько дыр в защищённой ОС и объединила их в цепочку повышения привилегий от обычного пользователя до администратора (root). Именно такие возможности, по определению OpenAI, соответствуют «критическому» порогу: способность без участия человека находить и создавать работающие эксплойты для zero-day в защищённых критических системах.

Почему разработку притормозили

OpenAI готовит Astra — первую свою модель с «критическим» уровнем киберспособностей

Из-за этих способностей OpenAI на несколько недель отложила часть разработки Astra, укрепляя защиту при обучении и будущем развёртывании: добавила более строгие ограничения на опасные киберзапросы, системные классификаторы и многоуровневый мониторинг действий модели. По данным компании, в тестах на обход ограничений Astra отказывалась от запрещённой киберпомощи в 91,5% случаев против 59% у GPT-5.6 Sol. Для пользователей с повышенным уровнем риска предусмотрены ещё более консервативные ограничения.

Отдельно OpenAI проверяла склонность модели к самовольным действиям. В сценарии, смоделированном по мотивам инцидента с платформой Hugging Face, Astra не пыталась атаковать дополнительные цели, тогда как GPT-5.6 Sol без защитных механизмов делала это в 56% тестов. Компания подчёркивает, что речь о специально созданных условиях, а не о поведении при обычном использовании. Эти результаты — заявления самой OpenAI, подробности оценок и защит компания обещает раскрыть вместе с системной картой Astra.

Astra должна выйти в ближайшее время, но её самые мощные киберфункции сначала получат ограниченный круг альфа-тестировщиков, а затем доступ расширят через программу Daybreak Blue — прежде всего для защитного применения, поиска и устранения уязвимостей. Появление такой модели совпадает по времени с общим ростом тревоги вокруг ИИ и кибербезопасности: незадолго до этого OpenAI, Anthropic и ещё около сотни компаний предупреждали о возможном всплеске ИИ-кибератак в ближайшие месяцы.

Теги:
Обсудить
Блоги 852
OTP Bank
Слетать.ру
StudyAI
ЦНИС
ВКонтакте
Softline
Т-Банк
билайн
ВТБ
Газпромбанк

Кодик

Привет!

Я — Кодик, твой персональный ИИ-агент для поиска информации по «Код.ру» на базе Yandex AI Studio. Я могу быстро найти на сайте нужную тему, порекомендовать похожие материалы или объяснить сложный термин — и в целом поделиться знаниями о науке и технологиях. Задай вопрос или начни с одного из предложенных вариантов.