Корпорация OpenAI представила альфа-версию Advanced Voice Mode для ChatGPT, который предлагает гиперреалистичные аудиоответы на основе GPT-4o.
Advanced Voice Mode обладает мультимодальностью и позволяет обрабатывать аудио без дополнительных моделей, сокращая задержку взаимодействия.
В текущей версии доступны четыре голоса, созданные с участием профессиональных дикторов, при этом система не будет имитировать голоса знаменитостей, чтобы избежать конфликтов.
Компания отмечает, что диалог Advanced Voice Mode не отличим по интерактивности от беседы с реальным человеком.
================