Perplexity випустила дослідницьку версію нової моделі-оркестратора для своєї агентної платформи Perplexity Computer. В основі лежить відкрита китайська модель GLM 5.2 від Z.ai, яка пройшла додаткове постнавчання для роботи в агентному середовищі. Це не просто черговий AI-реліз, а продуманий крок для зниження операційних витрат без втрати якості.
Ключова інновація — гібридна архітектура. GLM 5.2 бере на себе виконання основної маси рутинних запитів, а при досягненні межі своїх можливостей автоматично передає завдання потужнішій моделі-раднику. За даними Perplexity, така зв'язка забезпечує продуктивність на рівні Opus 4.8 при вартості всього 0,344x від еталонної моделі. В індустрії, де кожен цент на рахунку, це серйозна конкурентна перевага.
Система вже доступна у форматі research preview. Повні бенчмарки компанія обіцяє опублікувати найближчими тижнями. Важливо розуміти: мова не йде про повну заміну топових моделей. GLM 5.2 — це економічний базовий шар, який дозволяє розподіляти навантаження між 19 моделями в рамках Perplexity Computer.
Примітний і геополітичний аспект. Perplexity використовує китайську відкриту модель Z.ai, яка з січня 2025 року перебуває в американському Entity List. Однак компанія розміщує адаптовану версію на власній інфраструктурі в США, повністю контролюючи шар постнавчання та маршрутизації. Це знижує залежність від зовнішніх API та дає повний контроль над виконанням завдань. Раніше Perplexity вже застосовувала аналогічний підхід з DeepSeek R1, випустивши її адаптовану версію R1-1776, очищену від цензурних обмежень.
GLM 5.2 містить близько 744 млрд параметрів і поширюється за ліцензією MIT, що дозволяє розробникам вільно її модифікувати. Наступним кроком Perplexity називає постнавчання Nemotron 3 Ultra — ще однієї відкритої моделі для Computer.
Думка експерта: Perplexity демонструє зрілий підхід до побудови агентних систем. Замість того, щоб покладатися виключно на дорогі пропрієтарні моделі, компанія грамотно використовує відкриті рішення як економічний фундамент, залишаючи за собою контроль над критичними шарами. Це не просто економія — це стратегічна незалежність від постачальників API та основа для масштабування агентних обчислень у реальному секторі.