OpenAI представила инструмент GPT-Live-1, позволяющий разработчикам создавать голосовые диалоги с ИИ, где модель говорит и слушает одновременно. Это делает общение с моделью более естественным и приближенным к живому разговору.
Мнение эксперта
- Для российского рынка это прежде всего вопрос доступности: API OpenAI официально не поставляется, поэтому спрос уйдёт в сторону локальных решений на базе Yandex SpeechKit, GigaChat и SberBank-стеков.
- Системному интегратору стоит закладывать в архитектуру двунаправленный аудиопоток и низкую задержку — это меняет требования к сети, GPU-мощностям и выбору подрядчика.
- Основной риск ИБ — постоянный открытый аудиоканал: потребуется локальная обработка или изоляция данных, иначе запись разговоров уйдёт за периметр заказчика.