OpenAI рассказала об архитектуре GPT-Live, системы для голосового общения с ИИ в реальном времени. В основе сервиса лежит turnless speech model, модель непрерывного диалога без жёсткого ожидания окончания реплики пользователя.
Как сообщает OpenAI News, команда собрала систему за шесть месяцев. Основное внимание уделили снижению задержек и более естественному ритму разговора. В компании отмечают, что низколатентная архитектура ускоряет отклик модели во время голосового взаимодействия.
По данным OpenAI, GPT-Live создавали для более отзывчивого общения с ИИ и непрерывного голосового обмена, без необходимости явно делить разговор на отдельные ходы. Для продуктовых команд это меняет сам подход к проектированию голосовых интерфейсов. Вместо привычной схемы «запрос-ответ» система должна постоянно обрабатывать речь и быстро переключаться внутри диалога. Это влияет и на инфраструктуру: непрерывная обработка аудио требует стабильной работы с минимальными задержками на всём протяжении разговора.
Ключевые факты
GPT-Live поддерживает continuous voice interaction с ИИ
В системе используется turnless speech model для непрерывного диалога
OpenAI заявила, что разработала систему за шесть месяцев
Архитектура GPT-Live ориентирована на снижение задержек при голосовом взаимодействии
Вопросы и ответы
- Чем GPT-Live отличается от обычных голосовых интерфейсов с ИИ?
Система использует turnless speech model: диалог идёт непрерывно, без жёсткого ожидания окончания реплики пользователя и разделения разговора на отдельные ходы.
- Что OpenAI меняла в архитектуре GPT-Live на практике?
Команда сфокусировалась на снижении задержек при голосовом взаимодействии. По заявлению OpenAI, низколатентная архитектура ускоряет отклик модели и делает ритм разговора более естественным.
- Сколько времени заняла разработка GPT-Live?
OpenAI заявила, что собрала систему непрерывного голосового взаимодействия за шесть месяцев.
Контекст по теме
- OpenAI добавила в API модели gpt-realtime-2.1 и gpt-realtime-2.1-mini для голосовых агентов7 июля 2026 г.
- AI Gateway добавил поддержку аудио и голосовых агентов в реальном времени29 июня 2026 г.
- Инструмент OpenAI WebRTC Audio Session получил поддержку контекста из документов13 июня 2026 г.
- OpenAI представила GPT-Realtime-2, а Anthropic, Natural Language Autoencoders и исследовательский институт9 июня 2026 г.
