Skip to main content
POST
Speech to Text

Authorizations

Authorization
string
header
required

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Body

multipart/form-data
files
file[]
required

Audio files to be transcribed (max 10). Types accepted are: audio/mp3, audio/mpeg, audio/x-mp3, audio/wav, audio/wave, audio/x-wav, audio/x-pn-wav, audio/aac, audio/m4a, audio/x-m4a, audio/x-mp4, audio/ogg, audio/opus, audio/x-ms-wma, audio/wma

model
enum<string>
required
Available options:
pawa-stt-v1-20240701
Example:

"pawa-stt-v1-20240701"

language
enum<string>
required
Available options:
English,
Swahili,
Luo,
Meru,
Kamba,
Kikuyu,
Hausa,
Igbo,
Yoruba,
Pidgin,
Zulu,
Tswana,
Afrikaans,
Xhosa,
Nyankole,
Ganda,
Lugbara
Example:

"English"

is_speaker_diarization
enum<boolean>
required
Available options:
true,
false
Example:

false

prompt
string
Example:

"Nipe maneno yaliyokwenye hii audio"

temperature
number
default:0.1
Example:

0.1

Response

Audio files transcribed successfully

success
boolean
required
Example:

true

message
string
required
Example:

"Audio transcribed succesfully"

data
object
required