Skip to main content
Elumenta поддерживает три типа аудио: синтез речи (TTS), распознавание речи (STT) и генерация музыки — все через единый эндпоинт /api/v2/generate.

Синтез речи (TTS)

Сравнение TTS моделей

Для реального времени используйте elevenlabs-flash. Для предзаписанного контента — elevenlabs-v2 или openai-tts-hd.

Распознавание речи (STT)

Генерация музыки

Две модели для разных задач:

MusicGen (Replicate)

ElevenLabs Music

Советы по промптам