ChatGPT научился говорить и слушать одновременно
OpenAI выпустила GPT-Live — голосовой режим ChatGPT, который слушает и отвечает одновременно, передавая сложные задачи GPT-5.5.
OpenAI выпустила GPT-Live — голосовой режим ChatGPT, который больше не ждёт, пока человек договорит.
Раньше голосовой ассистент работал по очереди: сказал — жди ответа. GPT-Live слушает и говорит одновременно, как это делают живые люди в разговоре. Модель по несколько раз в секунду решает: продолжать слушать, ответить, помолчать, перебить или вызвать инструмент. Может вставить «угу» или «понял», чтобы показать — она следит за мыслью. Собеседника можно перебить самому или попросить говорить помедленнее.
Главная проблема голосовых ассистентов — они были глупее текстового чата. GPT-Live решает это разделением труда: разговор ведёт быстрая голосовая модель, а сложные вопросы — поиск в интернете, рассуждения, работу с инструментами — она в фоне передаёт GPT-5.5. Пока тот думает, беседа не прерывается.
Разница в качестве заметна на тестах. На экзамене по научным рассуждениям GPQA новая модель набирает 84,2% против 45,3% у прежнего голосового режима. На тесте поиска в интернете BrowseComp — 75,2% против 0,7%. В симуляции звонков в техподдержку GPT-Live решает около 65% задач, старая версия — 30%.
Доступны две версии: GPT-Live-1 для платных подписок Go, Plus и Pro, и облегчённая GPT-Live-1 mini — бесплатно. Работают в приложениях на iOS, Android и на сайте ChatGPT. Доступ через API появится позже.
Из нового — карточки с погодой, курсами акций и счётом матчей прямо в голосовом чате, обновлённые голоса. Видео и демонстрация экрана в GPT-Live пока не поддерживаются — для этого остаётся старый режим.
Более человечный голос — это ещё и риск: люди привязываются к ассистентам эмоционально. OpenAI добавила защиту прямо во время разговора — модель может мягко скорректировать ответ или прервать беседу в опасной ситуации, а при упоминании самоповреждения показывает контакты кризисных линий.