Skip to main content
Transkrypcja mediów

Transkrypcja mediów

Prześlij plik audio lub wideo i otrzymaj bezpośrednio jego transkrypcję. Ten samodzielny punkt końcowy nie tworzy projektu dubbing. Punkt końcowy akceptuje pliki o rozmiarze do 200 MB i długości 2 godzin. Wykorzystuje te same zasady dostępu za pomocą klucza API, co API tłumaczenia. Pomyślne żądania zwracają HTTP 200.

Żądanie

Wyślij multipart/form-data z następującymi polami.
string
wymagane
Twój klucz API VoiceCheap.
file
wymagane
Plik audio lub wideo do transkrypcji. Obsługiwane formaty to MP4, MOV, MKV, WebM, MPEG, MP3, WAV, M4A, FLAC, OGG i AAC.
string
domyślnie:"json"
Format odpowiedzi: json, srt lub vtt.
string
domyślnie:"auto-detect"
Obsługiwany kod ISO języka źródłowego. Pozostaw jako auto-detect, chyba że znasz język źródłowy. Nieobsługiwane jawne języki zwracają błąd walidacji przed rozpoczęciem przetwarzania.
string
domyślnie:"auto-detect"
auto-detect lub liczba całkowita od 1 do 32.
string
Tablica ciągów JSON zawierająca nazwy, marki, akronimy lub terminy domenowe do rozpoznania. Żądane terminy są scalane z zapisanym glosariuszem konta lub zespołu.
boolean
domyślnie:"true"
Usuń typowe wypełniacze z transkrypcji.
boolean
domyślnie:"false"
Dodaj prefiks do znaczników SRT za pomocą Speaker N: lub dodaj tagi głosowe VTT. JSON zawsze zawiera numer mówcy przy każdym segmencie i słowie.

Odpowiedź JSON

JSON to najbardziej kompletny format wyjściowy. Zawiera pełny tekst, pewność językową, czas trwania mediów, mówców, segmenty z sygnaturami czasowymi oraz słowa z sygnaturami czasowymi.

Przykłady

Błędy