Generador de subtítulos
Transcribe el habla y crea un archivo de subtítulos.
Esta herramienta funciona con JavaScript. Para usarla, activa JavaScript en tu navegador y recarga la página.
CONVIERTE LA VOZ EN SUBTÍTULOS.
El Generador de subtítulos convierte en texto el habla de un archivo de vídeo o audio y te lo entrega como archivo de subtítulos sincronizado. La salida SRT se usa en reproductores, al subir a YouTube y en programas de edición; la salida VTT, en reproductores web (HTML5). Para el reconocimiento de voz, el modelo abierto Whisper de OpenAI se ejecuta en el servidor; puedes elegir entre 16 idiomas, incluido el turco, o dejar que se detecte solo. Los subtítulos se rehacen para que sean legibles: como mucho dos líneas, como mucho 42 caracteres por línea, como mucho 6 segundos, cortados al final de frase.
La grabación sale solo del archivo que subes; no hay campo para pegar un enlace ni una dirección de vídeo. El audio se transcribe con un modelo Whisper que corre en el servidor; nunca se envía a un servicio externo y se borra al terminar la tarea. Elige el idioma si lo conoces: la detección automática mira los primeros 30 segundos y puede fallar en grabaciones mixtas o con ruido. El modelo “Equilibrado” basta para la mayoría de las grabaciones y la tarea dura más o menos lo que la grabación; el modelo “Mejor” capta mejor nombres y jerga, pero es 3–4 veces más lento y se usa en grabaciones de hasta 10 minutos. Una grabación puede durar como máximo 30 minutos; si es más larga, divídela primero con “Cortar vídeo” o “Cortar audio”. El resultado aparece en pantalla, se copia y se descarga como archivo; léelo y corrígelo siempre antes de publicar: los nombres propios, la jerga y los pasajes con ruido son donde más errores hay.
De principio a fin
- Sube tu vídeo o archivo de audio. MP4, MOV, MKV, WebM, MP3, WAV, M4A, FLAC… Se lee la duración.
- Elige el idioma y el formato. Elige el idioma si lo conoces; SRT para casi todo, VTT para reproductores web. Modelo: Equilibrado.
- Descarga los subtítulos. Los subtítulos aparecen en pantalla y se pueden copiar; el archivo se descarga. Lee, corrige y luego publica.
Preguntas frecuentes
¿SRT o VTT?
SRT es el formato más común: VLC, YouTube, Premiere, DaVinci Resolve y la mayoría de los reproductores lo leen. VTT es el formato que espera la etiqueta de vídeo HTML5 del navegador; elige VTT si lo vas a incrustar en un sitio web. El contenido es el mismo; solo cambia la notación.
¿Puedo dar un enlace de YouTube u otro?
No. La herramienta funciona solo con el archivo que subes; a propósito no hay campo para pegar enlaces. Descargar el contenido de otro servicio va contra sus condiciones de uso.
¿Qué tan preciso es?
En una grabación limpia (un hablante, micrófono cercano) el modelo “Equilibrado” acierta la gran mayoría de las palabras; los nombres propios, las siglas y los términos técnicos pueden confundirse. El ruido, un micrófono lejano y las voces superpuestas aumentan los errores. El modelo “Mejor” es claramente más preciso, pero más lento. Toma el resultado como un borrador y léelo antes de publicar.
¿Mi archivo se queda en el servidor?
No. Tu archivo solo llega al servidor para procesarse y se elimina al terminar el trabajo; el resultado también se elimina cuando lo descargas y sales de la herramienta. No necesitas cuenta, nombre ni correo electrónico, y tus archivos nunca se envían a un servicio de terceros. El uso es gratuito: no ponemos ninguna cuota por hora ni por día al número de procesos, no te hacemos ver anuncios antes de procesar y no añadimos marca de agua al resultado.
Otras herramientas de Audio
RUPO Studio