Найбільший російський банк представив амбітне рішення у сфері кібербезпеки: систему мультимодальних ІІ-агентів для автоматичного виявлення фішингових ресурсів. Про нову розробку було оголошено в рамках конференції Offzone 2026.

Архітектура рішення передбачає комплексний аналіз веб-сторінки одразу за кількома векторами: текст, програмний код, інфраструктура та візуальне оформлення. Зібрані дані проходять через багатоступеневу систему верифікації, де одні агенти формують докази наявності загрози, інші — спростовують її, а фінальне рішення виносить окремий модуль на основі сукупності доказів.

Масштаб проблеми, з якою стикаються фінансові організації, справді вражає: щодня у світі реєструється понад 11 тисяч нових фішингових сайтів, причому значна частина з них існує лише кілька годин. Поширення генеративного ІІ багаторазово прискорило процес створення таких сторінок, роблячи ручну перевірку практично марною.

На поточному етапі система проходить фінальне навчання та функціонує в режимі асистента для фахівців: проводить первинний аналіз, розставляє пріоритети та готує звіти для блокування, тоді як остаточне рішення залишається за людиною. Однак у планах банку — повний перехід до автоматичного блокування виявлених ресурсів. Технологію також інтегрують у платформу X Threat Intelligence, до якої вже підключено понад 760 російських організацій, що суттєво розширить охоплення автоматизованого пошуку сайтів, які імітують бренди компаній.

ІІ у ролі вартового та атакуючого

Цей крок — лише частина ширшої стратегії Сбера щодо впровадження автономних систем. Раніше банк уже презентував «ГігаАгента» — універсального помічника, здатного самостійно планувати завдання, модифікувати власний код і зберігати контекст між сесіями. Аналогічні тенденції спостерігаються й в інших гравців: МТС модернізувала ІІ-моделі сервісу «Захисник», де три нейромережі оцінюють понад 1,1 тисячі параметрів кожного дзвінка, а час реакції на шахрайство скоротився з 30 до 15 секунд.

Роль автономних агентів в інтернеті стрімко зростає. Ілон Маск підтримав прогноз Cloudflare про те, що до 2026 року нелюдський трафік може перевищити користувацький, а через п'ять років — перевершити його в 1000 разів. Однак автономність впирається в технічні обмеження: дослідник під псевдонімом codila вказує на «амнезію» одиночних агентів і пропонує графову архітектуру, де агенти розділяють спільну пам'ять і перевіряють роботу один одного.

Розширення таких систем відкриває й нові вразливості. Американські дослідники продемонстрували атаку Ghostcommit: шкідлива команда ховається всередині зображення, перевіряючий агент її не відкриває, а інший помічник зчитує інструкцію та переносить паролі у відкритий код.

Мій погляд: гонка озброєнь між ІІ-захистом та ІІ-атаками лише починається. Поки банки роблять ставку на мультимодальність і колективний розум агентів, зловмисники експлуатують довіру між компонентами систем. Ключовим фактором успіху стане не швидкість блокування, а здатність архітектури виявляти аномалії в поведінці самих агентів — інакше «мисливці» ризикують стати новою ціллю для фішингу.