В індустрії штучного інтелекту сталася знакова подія: OpenAI вперше присвоїла своїй майбутній моделі Astra найвищий рівень кібербезпеки — Critical. Це рішення, ухвалене 1 вересня в межах внутрішнього Preparedness Framework, сигналізує про те, що ми вступаємо в нову еру, де ШІ стає не просто інструментом, а самостійним дійовим суб'єктом у кібервійнах.
Важливо підкреслити: йдеться не про стандартну версію моделі, а про конфігурацію з розширеним доступом, відому як Daybreak Blue. Саме в цій модифікації Astra продемонструвала можливості, які раніше вважалися теоретичними. Моя експертиза підказує, що такий крок — це водночас і визнання потужності технології, і спроба заздалегідь вибудувати систему стримувань і противаг.
Ключові результати випробувань
Згідно з критеріями Preparedness Framework, рівень Critical присвоюється системам, здатним автономно виявляти та експлуатувати zero-day вразливості в реальних захищених системах. І Astra підтвердила цей статус на практиці. На публічному бенчмарку ExploitBench вона досягла 100% результату, що вже саме по собі вражає.
Однак найбільш показовими стали внутрішні тести. OpenAI створила ізольовану версію ExploitBench із 20 свіжими вразливостями високого ступеня небезпеки в рушії V8, щоб уникнути забруднення навчальних даних. Astra не лише знайшла, а й успішно використала дві раніше невідомі zero-day вразливості в складі складного ланцюжка атаки. Більше того, в експертних сценаріях модель продемонструвала здатність виходити з пісочниці захищеного браузера та виконувати команди на основній системі, а також підвищувати привілеї до root у захищеній ОС.
Обмеження та стратегія безпеки
Усвідомлюючи колосальний ризик, OpenAI вжила безпрецедентних заходів обережності. На початковому етапі доступ до розширених кіберможливостей Astra отримає лише обмежене коло тестувальників. Модель була додатково навчена відмовлятися від забороненої кібердопомоги: у тестах на спроби обходу обмежень вона відхилила 91,5% шкідливих запитів, що значно вище за показник у 59% у попередньої версії GPT-5.6 Sol.
Компанія також впроваджує автоматизовані системи моніторингу для виявлення та зупинки несанкціонованих дій моделі в реальному часі. Це нагадує гонку озброєнь, де наступальні можливості мають постійно врівноважуватися оборонними заходами.
Мій аналіз: рішення OpenAI — це подвійний прецедент. З одного боку, це демонстрація технологічного лідерства, з іншого — визнання того, що ШІ вже досяг рівня, коли його кіберспроможності потребують обмежень на рівні національної безпеки. Питання не в тому, чи зможе ШІ здійснювати атаки, а в тому, хто і як контролюватиме цей потенціал. Ринок має усвідомити: інвестиції в ШІ тепер нерозривно пов'язані з інвестиціями в кібербезпеку.