Skip to main content
Transcribir medios

Transcribir medios

Suba un archivo de audio o video y reciba su transcripción directamente. Este endpoint independiente no crea un proyecto de doblaje. El endpoint acepta archivos de hasta 200 MB y 2 horas. Utiliza las mismas reglas de acceso mediante clave API que la API de traducción. Las solicitudes exitosas devuelven HTTP 200.

Solicitud

Envíe multipart/form-data con los siguientes campos.
string
requerido
Su clave API de VoiceCheap.
file
requerido
El archivo de audio o video a transcribir. Los formatos admitidos incluyen MP4, MOV, MKV, WebM, MPEG, MP3, WAV, M4A, FLAC, OGG y AAC.
string
predeterminado:"json"
Formato de respuesta: json, srt o vtt.
string
predeterminado:"auto-detect"
Código ISO del idioma de origen admitido. Déjelo como auto-detect a menos que conozca el idioma de origen. Los idiomas explícitos no admitidos devuelven un error de validación antes de que comience el procesamiento.
string
predeterminado:"auto-detect"
auto-detect o un número entero de 1 a 32.
string
Una matriz de cadenas JSON de nombres, marcas, acrónimos o términos de dominio a reconocer. Los términos de la solicitud se combinan con el glosario guardado de la cuenta o del equipo.
boolean
predeterminado:"true"
Elimine las muletillas comunes de la transcripción.
boolean
predeterminado:"false"
Prefije las señales SRT con Speaker N: o añada etiquetas de voz VTT. JSON siempre incluye el hablante numérico en cada segmento y palabra.

Respuesta JSON

JSON es la salida más completa. Contiene el texto completo, la confianza del idioma, la duración de los medios, los hablantes, los segmentos con marca de tiempo y las palabras con marca de tiempo.

Ejemplos

Errores