Распознавание речи на Python

Урок 14 из 20 курса «ElevenLabs: примеры»: официальный курс ElevenLabs Cookbook (Илевен Лабс) на русском языке. Урок входит в платный доступ; первые уроки курса бесплатно.

О чём урок

Прежде чем писать какой-либо код, вызовите навык /speech-to-text, чтобы изучить правильные паттерны ElevenLabs SDK. Создайте минимальный скрипт, который транскрибирует аудио с помощью ElevenLabs Scribe v2. Импортируйте всё в начале файла. Вызовите load_dotenv() после импортов, затем явно передайте api_key=os.environ["ELEVENLABS_API_KEY"] клиенту ElevenLabs. Прочитайте первый CLI arg как необязательный путь к аудиофайлу; по умолчанию — ./audio.mp3. Используйте клиент ElevenLabs и вызовите Speech-to-Text с model_id="scribe_v2". Выведите текст транскрипции в stdout. Обработайте ошибки с читаемым сообщением.

Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.

Полезные гиды