Індустрія штучного інтелекту здійснила черговий якісний стрибок. OpenAI офіційно анонсувала GPT-Live — нове покоління голосових моделей, яке вже інтегровано в режим «Розмова» в ChatGPT. Це не просто оновлення, а фундаментальний зсув у тому, як ми взаємодіємо з нейромережами.

Ключове нововведення — повнодуплексна архітектура. На відміну від попередніх рішень, GPT-Live здатна одночасно слухати та говорити. Модель більше не чекає, поки користувач замовкне, щоб почати відповідь. Вона розпізнає вигуки, робить природні паузи і, що особливо важливо, не перебиває, якщо людина просто замислилася. Це робить діалог зі ШІ максимально наближеним до людського.

Архітектура системи розділяє процеси спілкування та виконання завдань. Поки GPT-Live підтримує активний діалог, у фоновому режимі працює інша модель (на старті це GPT-5.5). Вона займається пошуком інформації в інтернеті або проводить складні обчислення. Такий підхід дозволяє ШІ перекладати мову в реальному часі та вирішувати запити без переривання бесіди.

За результатами внутрішніх тестів, GPT-Live значно перевершує попередні версії в наукових міркуваннях та аналізі даних. В інтерфейсі ChatGPT також з'явилися візуальні картки — тепер можна миттєво отримати інформацію про погоду, курси акцій або спортивні результати, не виходячи з діалогу.

OpenAI випустила дві версії: флагманську GPT-Live-1 та полегшену GPT-Live-1 mini. Доступ до основної моделі відкритий для підписників тарифів Plus і Pro. Користувачі безкоштовної версії ChatGPT можуть скористатися mini-версією. Найближчим часом компанія планує відкрити API для розробників, що, безсумнівно, призведе до масової інтеграції технології в сторонні сервіси.

Особливу увагу приділено безпеці. У систему впроваджено нові фільтри, які блокують спроби імітації чужих голосів та обмежують контент, пов'язаний із насильством або самопошкодженням. Для підлітків передбачено батьківський контроль. Це своєчасний крок, враховуючи зростаючі побоювання щодо використання голосових deepfake.

Думка експерта. GPT-Live — це не просто покращення голосового асистента. Це перехід до нової парадигми взаємодії людини та машини, де стирається межа між розмовою зі ШІ та живою співрозмовницею. Ми спостерігаємо не еволюцію, а революцію в UX-дизайні AI-продуктів.