Новини криптоміра

14.08.2026
08:49

Z.ai представляє GLM-5.3: прорив у програмуванні та кібербезпеці

ИИ-агенты AI agents

Китайський стартап Z.ai офіційно анонсував вихід мовної моделі GLM-5.3, яка знаменує значний крок уперед у сфері автоматизованого програмування, агентних сценаріїв і пошуку вразливостей. На відміну від попередніх ітерацій, розробники наголошують, що приріст продуктивності досягнуто виключно завдяки пост-тренувальним процедурам, без зміни базової архітектури моделі.

Ключові покращення та бенчмарки

На внутрішньому тесті Code Bench, що оцінює навички написання коду, GLM-5.3 продемонструвала покращення на 50% порівняно з попередницею GLM-5.2. У релізній таблиці Z.ai наводить вражаючі результати за низкою спеціалізованих тестів:

  • Terminal Bench 3.0: 28,3 бала проти 4,6 у GLM-5.2 — шестиразове зростання;
  • DeepSWE v1.1: 66,9 проти 46,2;
  • Agents' Last Exam: 28,5 проти 23,8;
  • CyberGym: 84,5% проти 77,2%;
  • ExploitBench: 54,4% проти 24,4% — більш ніж двократне збільшення.

Особливої уваги заслуговує ExploitGym, де модель закрила 105 задач за двогодинний бюджет, тоді як GLM-5.2 справлялася лише з 29. При збільшенні бюджету до шести годин показник зріс до 130 задач проти 39 у попередньої версії. Ці цифри наочно демонструють, що Z.ai вдалося значно підвищити ефективність моделі у вирішенні складних, багатоетапних задач.

Практичне застосування в кібербезпеці

У рамках релізу компанія провела масштабне тестування на реальних кодових базах спільно з кількома командами з безпеки в Китаї. Після перевірки та дедуплікації система виявила 2436 вразливостей у 269 проєктах, включно з 1097 проблемами середньої та високої критичності. Публічно розкрито лише 53 знахідки, решта 2383 залишаються під ембарго. Середній «термін життя» виявлених вразливостей оцінюється в 26,6 року, а найстаріша з них датується 1981 роком — це свідчить про глибину аналізу та здатність моделі знаходити давно вкорінені проблеми.

Для прозорості процесу Z.ai запустила публічний реєстр Z.ai Security Disclosure Ledger, де фіксуються статус розкриття, зачеплені проєкти та рівень критичності. Це важливий крок для побудови довіри в спільноті розробників.

Продуктові зміни та перспективи

GLM-5.3 уже розгорнута для підписників GLM Coding Plan, позиціонуючись як основний рушій для агентного програмування та «довгих» задач. Запити до старих моделей автоматично маршрутизуються на нову версію, що забезпечує безшовний перехід для користувачів. Відкриті ваги моделі будуть опубліковані через два тижні після завершення оцінки безпеки та додаткового харденінгу.

Варто зазначити, що в липні минулого року Anthropic звинувачувала Z.ai у несанкціонованій дистиляції GLM-5.2 на відповідях Claude і GPT. Однак нинішній реліз демонструє, що компанія не зупиняється в розвитку, і її підхід до пост-тренування приносить відчутні результати.

Мій аналітичний висновок: Успіх GLM-5.3 у задачах кібербезпеки — це не просто маркетинговий хід, а сигнал про зрілість ІІ-агентів для практичного застосування в enterprise-сегменті. Здатність моделі знаходити вразливості з «віком» у десятиліття відкриває нові можливості для аудиту легасі-коду, що може стати ключовим драйвером впровадження таких систем у корпоративне середовище.