главное в кибербезопасности Читать в канале
ИИ и безопасность 3 сентября 2026 2 мин

OpenAI создала ИИ Astra для поиска 0-day и эксплойтов

OpenAI представила ИИ Astra для поиска уязвимостей и эксплойтов

OpenAI объявила о разработке языковой модели Astra. Компания назвала её первой моделью, достигшей критического порога возможностей в кибербезопасности. Astra способна автономно находить уязвимости нулевого дня и создавать эксплойты. В тестах модель обнаружила неизвестные уязвимости в браузере и построила полную цепочку компрометации с выполнением команд на хосте. В OpenAI заявили, что при разработке Astra учли опыт инцидента с Hugging Face. Обучение модели приостанавливали для повышения стандартов безопасности. Циклы обучения возобновились 28 августа.

Astra выявляет уязвимости и создает эксплойты

Критический порог возможностей означает, что для модели требуются максимально строгие меры защиты. Astra достигает этого порога при выявлении уязвимостей нулевого дня и создании эксплойтов для критически важных систем. Модель также разрабатывает и реализует комплексные стратегии кибератак без вмешательства человека. В OpenAI сравнили Astra с GPT-5.6 Sol, отметив превосходство Astra в кибербезопасности. Модель эффективнее расходует токены и лучше выявляет уязвимости. Astra показала максимальный результат в тесте ExploitBench на способность создавать эксплойты. В другом тесте, с использованием 20 уязвимостей V8 за июнь-август 2026 года, Astra чаще GPT-5.6 Sol добивалась выполнения произвольного кода, используя меньше токенов. Модель нашла уязвимости в защищенной ОС и объединила их в цепочку повышения привилегий до root. Эти результаты подтверждают достижение моделью критического порога.

Внедрены многоуровневые меры защиты от злоупотреблений

OpenAI выделила два основных пути для защиты: предотвращение использования модели злоумышленниками и контроль несанкционированных действий самой модели. Меры защиты от злоупотреблений включают отказы модели, системные классификаторы безопасности, автономное обнаружение угроз и анализ контекста. В тестах на киберджейлбрейки Astra отказывала в 91,5% случаев, GPT-5.6 Sol — в 59%. Для аккаунтов с повышенным риском установлены отдельные меры, требующие отказа в более широком спектре помощи. OpenAI проводит внутренний и внешний red teaming, а также регрессионные тесты. Внедрена система мониторинга несогласованного поведения Astra, которая анализирует действия модели и останавливает потенциально вредоносную активность. Доступ к модели предоставят в ближайшее время, но продвинутые возможности будут ограничены. Первыми доступ получат альфа-тестировщики, затем планируется запуск через Daybreak Bleue для защитных сценариев. OpenAI ожидает, что при выпуске Astra будут созданы дополнительные препятствия для предотвращения злоупотреблений. Это может замедлить или приостановить защитные операции.

Опубликовано в канале 3 сентября, 18:33

Каждый материал сайта выходит в канале в тот же момент.

Источники: SecPost · BleepingComputer