Новини криптоміра

14.08.2026
08:27

Z.ai представляє GLM-5.3: прорив в агентному програмуванні та кібербезпеці

ИИ-агенты AI agents

Китайський технологічний стартап Z.ai офіційно анонсував вихід своєї нової мовної моделі GLM-5.3. Це оновлення знаменує собою значний крок вперед у сфері програмування, агентних сценаріїв та пошуку вразливостей, зміцнюючи позиції компанії на ринку ШІ-рішень.

Еволюція без зміни архітектури

Ключова особливість релізу — вражаючий приріст продуктивності, досягнутий виключно за рахунок посттренування, без зміни базової архітектури. Порівняно з попередньою версією GLM-5.2, нова модель демонструє покращені результати на внутрішньому бенчмарку Code Bench, показавши зростання на 50%. Це свідчить про високий потенціал оптимізації алгоритмів навчання.

Вражаючі результати тестів

У релізній таблиці Z.ai представлені переконливі цифри за низкою ключових бенчмарків:

  • Terminal Bench 3.0 — 28,3 бала проти 4,6 у попередника;
  • DeepSWE v1.1 — 66,9 проти 46,2;
  • Agents' Last Exam — 28,5 проти 23,8;
  • CyberGym — 84,5% проти 77,2%;
  • ExploitBench — 54,4% проти 24,4%.

Особливої уваги заслуговує ExploitGym: модель закрила 105 задач за двогодинний бюджет, тоді як GLM-5.2 справлялася лише з 29. При збільшенні бюджету до шести годин показник зріс до 130 задач проти 39 у попередньої версії. Це демонструє серйозний прогрес в автономному пошуку вразливостей.

Практичне застосування та безпека

Z.ai провела масштабне тестування на реальних кодових базах спільно з кількома командами з безпеки в Китаї. Після перевірки та дедуплікації система виявила 2436 вразливостей у 269 проєктах, включаючи 1097 проблем середньої та високої критичності. Публічно розкрито 53 знахідки, решта 2383 залишаються під ембарго. Середній «термін життя» таких вразливостей оцінюється у 26,6 року, а найстаріша з виявлених датується 1981 роком.

Для прозорості процесу компанія запустила Z.ai Security Disclosure Ledger — публічний реєстр, що відстежує статус і критичність знахідок. Паралельно GLM-5.3 вже розгорнута для підписників GLM Coding Plan, ставши основним рушієм для агентного програмування та «довгих» задач. Відкриті ваги будуть опубліковані через два тижні після оцінки безпеки.

Мій аналітичний погляд: Z.ai демонструє вражаючу динаміку, особливо у сфері кібербезпеки, де результати GLM-5.3 виглядають революційними. Однак варто враховувати, що компанія раніше піддавалася звинуваченням у несанкціонованій дистиляції технологій, що може вплинути на довіру ринку. Тим не менш, якщо модель підтвердить заявлені характеристики в незалежних тестах, це може стати серйозним викликом для західних конкурентів.