OpenAI представила GPT-Live для природного голосового спілкування 

Ярослава Несисюк2 місяці тому

Час прочитання: 1 хвилина

OpenAI представила GPT-Live для природного голосового спілкування 

OpenAI представила GPT-Live — нове покоління голосових моделей для ChatGPT. Вони підтримують одночасне прослуховування й відповідь, можуть виконувати складніші завдання через GPT-5.5 і вже почали розгортатися для користувачів у всьому світі.

Природне спілкування голосом

GPT-Live побудована на архітектурі full-duplex, яка дозволяє моделі одночасно слухати користувача й відповідати, а не чекати завершення репліки. 

Завдяки цьому ChatGPT може підтримувати природніший діалог, робити короткі підтвердження на кшталт «ага» чи «розумію», не перебивати співрозмовника під час пауз і навіть виконувати синхронний переклад.

Коли запит потребує пошуку в інтернеті, глибшого аналізу або складних міркувань, GPT-Live передає його моделі GPT-5.5, але водночас продовжує підтримувати розмову. 

OpenAI зазначає, що в майбутньому голосова модель автоматично використовуватиме новіші флагманські моделі компанії.

ChatGPT отримав нові можливості

Разом із GPT-Live компанія оновила голосовий режим ChatGPT. 

Тепер він краще розпізнає голос користувача на тлі шуму, може чекати, поки людина сформулює думку, а також показує візуальні картки для прогнозу погоди, спортивних результатів, біржових котирувань та інших тем.

Користувачі зможуть обирати рівень міркувань моделі: Instant для швидких відповідей або Medium і High, якщо потрібно більше часу на аналіз.

Доступ до моделі

OpenAI повідомила, що GPT-Live почали розгортати для користувачів ChatGPT на iOS, Android і ChatGPT.com.

Модель GPT-Live-1 стане стандартною для користувачів тарифів Go, Plus і Pro, тоді як безкоштовний тариф отримає GPT-Live-1 mini. Пізніше OpenAI також планує додати нові голосові моделі до API для розробників.

Більше матеріалів з розділу НовиниУсі з розділу