🛠 Голосовая модель GPT-Live-1 стала доступна по API
10 сентября OpenAI открыла API GPT-Live-1 — полнодуплексной голосовой модели из голосового режима ChatGPT. Она слушает и говорит одновременно: единый речевой стек заменяет каскад STT–LLM–TTS, перебивания и фоновый шум обрабатываются внутри одной модели. Рассуждения и инструменты делегируются бэкенд-модели — разговор идёт, пока та считает. Фронтенд стоит $0,05 за минуту.
🌍 Голосовые агенты перестают быть конвейером «распознавание + LLM + синтез»: голосовая линия не обрывается, пока бэкенд выполняет инструменты, а его можно заменить сторонней моделью.
👤 Разработчики подключают GPT-Live-1 через API: 12 новых голосов, ASR-транскрипты, телефония и настройка темпа и тона. Пользователи голосовых ботов смогут перебивать агента без пауз, пока он думает.
Источник 1: https://openai.com/index/introducing-gpt-live-1-in-the-api/ Источник 2: https://developers.openai.com/api/docs/guides/live
