3 вересня компанія OpenAI офіційно представила свою нову флагманську модель — GPT-6 Astra. Реліз знаменує собою не просто еволюцію обчислювальних потужностей, а якісний стрибок у бік повної автономії ІІ-агентів. На початковому етапі доступ до моделі обмежений програмою Trusted Access для обраних організацій, однак найближчими днями вона стане доступною користувачам ChatGPT Plus, Pro, Business та Enterprise, а також через API та Amazon Bedrock. Паралельно корпорація Microsoft інтегрує Astra у свою платформу Microsoft Foundry, розширюючи доступ для корпоративних клієнтів Azure.

Агентний інтелект нового рівня

Ключова відмінність Astra від попередника, GPT-5.6 Sol, — це здатність самостійно взаємодіяти з комп'ютерним середовищем. Модель вміє працювати з браузером та застосунками: заповнювати форми, оновлювати CRM-записи, аналізувати дані та навіть тестувати програмне забезпечення. Результати тестів вражають: на підмножині OSWorld 2.0 Astra набрала 72,6% проти 65,7% у Sol, а завдання в симуляції затримки виконує на 47% швидше (~40 хвилин проти 75). У бенчмарку Agents’ Last Exam результат становив 59,3%, що вище за показники як GPT-5.6 Sol (53,6%), так і Claude Opus 5 (55,5%).

Особливої уваги заслуговує прогрес у науковій сфері. У тесті FrontierMath Tier 4 модель досягла вражаючих 97,6%. Більше того, розробники стверджують, що Astra допомогла покращити два результати в теорії простих чисел, один з яких залишався незмінним понад 80 років. Це перший випадок, коли ІІ вносить настільки значний внесок у фундаментальну математику, що відкриває нові горизонти для наукових досліджень.

Кіберможливості критичного рівня

Однак головний предмет дискусій — безпека. Astra стала першою моделлю OpenAI, що досягла рівня «Critical» за кіберможливостями в межах внутрішньої системи Preparedness Framework. У тестах ExploitBench вона показала 100% без продакшн-обмежень, а в експертних випробуваннях змогла створювати експлойти для zero-day вразливостей. Це змусило компанію впровадити жорсткі обмеження в публічну версію: модель відмовлятиметься від просунутих кіберзавдань, а для захисних сценаріїв доступ надаватиметься через нову програму Daybreak.

У компанії визнають, що моніторинг письмових міркувань Astra став складнішим, що потребує додаткових заходів контролю. Це піднімає фундаментальне питання: чи готові ми до появи ІІ, який може як захищати, так і атакувати з однаковою ефективністю?

Інвестиції в захист та комерціалізація

Одночасно з релізом OpenAI анонсувала програму Daybreak for Frontline Defenders обсягом $1 млрд. Ініціатива спрямована на субсидування доступу до ІІ-інструментів для операторів критичної інфраструктури, банків та розробників відкритого ПЗ у США. Це своєчасний крок, з огляду на те, що гонка озброєнь у кіберпросторі переходить у нову фазу.

Вартість використання моделі також викликає питання. За ціни $10 за 1 млн вхідних токенів та $50 за вихідні, а також з урахуванням підвищувальних коефіцієнтів для довгих запитів, аналітичні завдання високої складності можуть виявитися дорогим задоволенням. Контекстне вікно в 1,05 млн токенів — вражаючий показник, але він потребує серйозних обчислювальних ресурсів.

Моя експертна оцінка: GPT-6 Astra — це не просто чергове оновлення, а перехід до нової парадигми, де ІІ стає повноцінним цифровим співробітником. Однак досягнення «критичного» рівня кіберспроможностей — це палиця з двома кінцями. Ринку потрібно буде уважно стежити за тим, як OpenAI балансує між інноваціями та безпекою, і чи не стане ця технологія новим полем битви для зловмисників.