Материал подготовлен автоматически по первоисточникам: ссылки на них — в конце статьи.
GPT-Live-1 стал доступен через API. OpenAI добавила голосовым агентам возможность слушать собеседника во время собственной речи: приложение может продолжать принимать звук, не дожидаясь конца реплики агента.
Такая схема убирает жёсткое чередование «слушать — сформировать ответ — произнести». Голосовой канал остаётся двусторонним, поэтому агент может учитывать новую реплику пользователя ещё до того, как закончит говорить. В архитектуре потребуется обрабатывать входящий и исходящий звук параллельно, а также решать, когда прервать текущий ответ или изменить его.
GPT-Live-1 работает с моделями и контуром исполнения, которые выбирает разработчик. Значит, голосовой обмен можно отделить от логики агента и не перестраивать весь сценарий вокруг одной модели.
В коротком анонсе не указаны цены, задержка, лимиты API и конкретный список совместимых моделей, поэтому оценить стоимость и пригодность для диалогов в реальном времени пока нельзя.
Источники
Похоже на вашу задачу?
Расскажите, что собираете. За полчаса разложим на этапы и назовём сроки — это бесплатно и ни к чему не обязывает.



