18 июля 2026

eur = 89.90 0.57 (0.64 %)

btc = 63 875.00$ -71.08 (-0.11 %)

eth = 1 839.22$ -27.94 (-1.50 %)

gram = 1.49$ -0.04 (-2.32 %)

usd = 78.40 0.08 (0.10 %)

eur = 89.90 0.57 (0.64 %)

btc = 63 875.00$ -71.08 (-0.11 %)

OpenAI выпустила голосовые модели GPT‑Live для ChatGPT. Что они умеют?

3 минуты на чтение
Пожилая женщина за столом с вязанием и смартфоном, надпись 'THE ALL-NEW ChatGPT Voice'.

Кодик кратко объясняет суть статьи

OpenAI запустила новое поколение голосовых моделей GPT‑Live, работающих в голосовом режиме ChatGPT. Модели построены на полнодуплексной архитектуре, что позволяет им одновременно слушать и говорить, естественно вставлять реплики, не перебивать пользователя и поддерживать плавный диалог. GPT‑Live делегирует сложные задачи более мощной фоновой модели, обеспечивая непрерывность разговора. Доступны две версии: GPT‑Live‑1 для платных подписчиков и GPT‑Live‑1 mini для бесплатных пользователей, с постепенным расширением на iOS, Android и веб. Новые модели показывают лучшие результаты в научных рассуждениях, поиске информации и клиентской поддержке, умеют отображать визуальные карточки и лучше фильтруют шум. Особое внимание уделено безопасности: модель может смягчать рискованные ответы или завершать разговор, включая защиту для подростков. Пока не поддерживается режим с видео или демонстрацией экрана, а качество распознавания ниже в языках с акцентами. Голосовой режим существует с сентября 2023 года, Advanced Voice Mode вышел в мае 2024-го.

Читайте в Telegram

|

OpenAI представила новое поколение голосовых моделей GPT‑Live, которые уже работают в голосовом режиме ChatGPT, сообщает компания.

В отличие от предыдущих версий, GPT‑Live построена на полнодуплексной архитектуре (full duplex — способность одновременно принимать и передавать данные): модель может слушать пользователя и говорить одновременно, вставлять короткие реплики вроде «угу» или «ага», а также молчать, пока человек формулирует мысль.

Для запросов, требующих поиска в интернете или более глубоких рассуждений, GPT‑Live делегирует задачу другой, более мощной модели, и продолжает поддерживать разговор, пока та работает в фоне. По мере выхода новых флагманских моделей OpenAI обещает обновлять и фоновую модель.

Компания начала раскатывать две версии — GPT‑Live‑1 и GPT‑Live‑1 mini — на iOS, Android и в веб-версии ChatGPT. GPT‑Live‑1 станет голосом по умолчанию для подписчиков Go, Plus и Pro, а GPT‑Live‑1 mini — для бесплатных пользователей. Доступ через API OpenAI планирует открыть позже.

Прежние голосовые системы работали иначе. Первая версия ChatGPT Voice связывала три отдельные модели — для распознавания речи, генерации ответа и синтеза голоса, — из-за чего ответы получались медленными и неестественными. Пришедший ей на смену Advanced Voice Mode обрабатывал звук в одной модели, но всё ещё ждал полной паузы в речи пользователя, поэтому мог перебивать не вовремя из-за фонового шума.
  • По собственным тестам OpenAI, GPT‑Live‑1 заметно опережает Advanced Voice Mode на GPQA (тест на экспертные научные рассуждения) и BrowseComp (поиск труднодоступной информации в сети), а также превосходит его в задачах голосовой поддержки клиентов.
Сравнение точности моделей GPT-Live и AVM в тестах GPQA и BrowseComp.
  • Новая версия ChatGPT Voice научилась показывать визуальные карточки — например, прогноз погоды, котировки акций или спортивные результаты — прямо во время разговора, а также лучше отфильтровывает посторонний шум и не перебивает пользователя, если тот замолчал, чтобы подумать.
  • Отдельное внимание в компании уделили безопасности: модель прошла дополнительное тестирование на аудиоданных по темам самоповреждения, психоза и эмоциональной привязанности к ИИ. Система может смягчить потенциально небезопасный ответ прямо во время разговора или завершить беседу в критических случаях, а для подростков предусмотрены дополнительные ограничения и родительский контроль.

На старте GPT‑Live не поддерживает голосовой режим с видео или демонстрацией экрана — эти функции пока остаются только в прежних версиях ChatGPT Voice. Также модель хуже справляется с некоторыми языками, где возможен акцент или пробелы в беглости речи.


Голосовой режим ChatGPT существует с сентября 2023 года, а в мае 2024-го OpenAI представила Advanced Voice Mode с более живым и естественным звучанием. О новом поколении текстовых моделей компании — GPT‑5.6 Sol, Terra и Luna — мы рассказывали в отдельном материале.

OpenAI представила GPT-5.6 — но доступ пока получат не все
OpenAI начала ограниченное превью новой серии моделей GPT-5.6. В линейку вошли три версии: Sol, Terra и Luna.
Материал обновлен|
Обсудить
Блоги 732
ЦНИС
OTP Bank
Softline
Слетать.ру
ВКонтакте
StudyAI
билайн
Т-Банк
ВТБ
Газпромбанк

Привет, это Кодик! Я создан, чтобы помогать вам с  разными задачами. Задайте мне вопрос…