OpenAI впервые признала свою модель обладателем критических кибервозможностей

OpenAI отнесла готовящуюся к выпуску модель Astra к критическому уровню кибервозможностей. По оценке самой компании, система при наличии соответствующих инструментов способна без пошагового руководства человека искать неизвестные уязвимости и разрабатывать способы их эксплуатации в хорошо защищённых системах.

На публичном ExploitBench, где проверяется создание эксплойтов для уже известных уязвимостей, Astra получила 100%. Затем OpenAI испытала модель на закрытом наборе из 20 недавно раскрытых критических уязвимостей движка V8. Во время этих тестов Astra обнаружила две новые уязвимости и включила их в работающую цепочку эксплуатации; сведения о них компания передаёт разработчикам.

В экспертных испытаниях модель смогла построить цепочку компрометации браузера с выходом из песочницы и выполнением команд в основной системе. В другом сценарии она объединила несколько уязвимостей защищённой операционной системы, чтобы повысить локальные привилегии до уровня root.

«Astra — первая модель, которую мы относим к этому уровню; она требует усиленных мер защиты до выпуска», — заявила OpenAI.

Компания подчёркивает, что результаты получены с доступом к специализированной среде Daybreak Blue, а не в стандартной пользовательской конфигурации. Полная системная карта Astra ещё не опубликована, независимого подтверждения заявленных результатов также нет.

OpenAI намерена сначала предоставить расширенные кибервозможности небольшой группе испытателей. Для Astra дополнительно обучены отказы от опасных запросов, внедрён мониторинг действий модели и предусмотрена автоматическая остановка потенциально несанкционированной активности. В тестах на обход защит Astra отказывала в 91,5% опасных запросов против 59% у GPT‑5.6 Sol.

#новости #ИИ #кибербезопасность
@digitaltimeslv

Original in Telegram: https://t.me/digitaltimeslv/10359