Microsoft представила модель ШІ для кібербезпеки MAI-Cyber-1-Flash, яка перевершила Mythos 5 та GPT-5.5-Cyber.

Компанія Microsoft здійснила значний прорив у сфері застосування штучного інтелекту для кібербезпеки, випустивши спеціалізовану модель MAI-Cyber-1-Flash. Ця модель уже інтегрована в систему пошуку вразливостей MDASH, яка, за заявами керівництва, демонструє результати, що перевершують такі відомі рішення, як Mythos 5 та GPT-5.5-Cyber, при цьому коштує на 50% дешевше за існуючу конфігурацію MDASH, засновану на GPT-5.4, 5.4-Mini та 5.3-Codex.
Ключовим показником ефективності стала оцінка в бенчмарку CyberGym, де зв'язка MAI-Cyber-1-Flash та MDASH набрала вражаючі 95,95%. Цей тест пропонує ІІ-агентам відтворити 1507 відомих вразливостей у 188 проєктах з відкритим кодом, оцінюючи відсоток успішно відтворених помилок у контрольованому середовищі. Для порівняння, GPT-5.5 Cyber показав 85,6%, Mythos 5 — 83,8%, а GPT-5.6 Sol — 83,6%. Важливо зазначити, що на момент публікації ці дані ще не були внесені до публічних рейтингів, що підкреслює новизну та ексклюзивність досягнення.

Архітектура MAI-Cyber-1-Flash заснована на гібридному підході: модель самостійно обробляє до 90% завдань, а найскладніші 10% перенаправляє на GPT-5.4. Це рішення дозволяє суттєво економити токени, зберігаючи високу точність. У рамках MDASH задіяно понад 100 спеціалізованих ІІ-агентів, кожен з яких виконує свою функцію: від аудиту коду та оскарження достовірності знахідок до створення Proof-of-Concept — робочого прикладу, що підтверджує наявність вразливості.
Генеральний директор Microsoft Сатья Наделла зазначив, що це перший випадок, коли оптимізована LLM компанії демонструє таку високу ефективність: «У поєднанні з MDASH модель MAI-Cyber-1-Flash забезпечує продуктивність світового рівня за 50% вартості провідних моделей».
На початковому етапі MDASH доступна обмеженій кількості користувачів через службу Microsoft Security Exposure Management на порталі Defender. Клієнти можуть сканувати репозиторії на GitHub, аналізувати знайдені вразливості, ранжовані від «малоймовірних» до «підтверджених», та використовувати Defender CLI для автоматичної генерації варіантів виправлення коду, які потім передаються на перевірку розробникам.
Експертний коментар: Цей крок Microsoft — не просто технологічне досягнення, а сигнал про зміну парадигми в кібербезпеці. Спеціалізовані ІІ-моделі, які дешевші та ефективніші за універсальні, можуть кардинально змінити ринок, зробивши високоякісний аудит коду доступним для малого та середнього бізнесу. Однак, як і у випадку з будь-якими ІІ-інструментами, критично важливо зберігати людський контроль на етапі верифікації результатів.