OpenAI зробила черговий крок в еволюції голосових інтерфейсів, анонсувавши GPT-Live — нове покоління голосових моделей, інтегрованих у режим «Розмова» ChatGPT. Це не просто оновлення, а фундаментальний зсув у тому, як ми взаємодіємо зі штучним інтелектом.

Ключова інновація — повнодуплексна архітектура. На відміну від попередників, GPT-Live здатний одночасно слухати та говорити, не чекаючи пауз. Модель розпізнає вигуки, природно робить паузи та не перебиває користувача, навіть якщо той замислився. Це наближає діалог зі ШІ до людського спілкування.

Архітектурно процес розділений: поки GPT-Live підтримує бесіду, інша модель (на старті — GPT-5.5) у фоновому режимі обробляє складні запити — пошук в інтернеті або обчислення. Це дозволяє ШІ перекладати мову в реальному часі та вирішувати завдання без переривання діалогу.

Тести підтверджують перевагу GPT-Live в наукових міркуваннях та вилученні даних. В інтерфейсі ChatGPT також з'явилися візуальні картки з погодою, курсами акцій та спортивними результатами — крок до більш мультимодального досвіду.

OpenAI випустила дві версії: потужну GPT-Live-1 та спрощену GPT-Live-1 mini. Доступність варіюється: користувачі платних тарифів Plus та Pro отримали доступ до основної моделі, безкоштовна версія ChatGPT використовує mini-версію. Найближчим часом компанія відкриє API для розробників.

Безпека також отримала оновлення: нові фільтри блокують імітацію голосів та обмежують контент, пов'язаний з насильством або самопошкодженням. Для підлітків передбачений батьківський контроль.

Цей запуск — стратегічно важливий крок. GPT-Live не просто покращує голосовий інтерфейс, але й змінює саму парадигму: ШІ тепер може бути повноцінним співрозмовником, а не просто інструментом. Однак справжній потенціал розкриється з відкриттям API — тоді розробники зможуть вбудувати цю технологію у свої продукти, що може перевизначити ринок голосових асистентів.