Generar subtítulos SRT automáticamente
Elige un archivo de audio o vídeo y obtén un archivo de subtítulos con códigos de tiempo (SRT). Con un vídeo puedes reproducirlo con los subtítulos superpuestos, y puedes corregir el texto en pantalla antes de exportar, de modo que quede listo para tu editor de vídeo.
La precisión baja mucho en este idioma con los modelos pequeños. Elige Whisper Small o uno mayor
Si sabes cuántas personas hablan, indicarlo mejora bastante la precisión
Cómo usar los subtítulos generados
SRT es el formato de subtítulos más extendido: YouTube, Premiere Pro, DaVinci Resolve y VLC lo leen directamente. Si das al archivo exportado el mismo nombre que el vídeo y lo dejas en la misma carpeta, la mayoría de reproductores lo detectan como pista de subtítulos automáticamente.
Los subtítulos generados automáticamente rara vez sirven tal cual. Los nombres propios, la puntuación y la longitud de línea se pueden corregir en pantalla antes de exportar. La función de reemplazo permite arreglar de una vez un error de transcripción que se repite. Si cargaste un vídeo, reprodúcelo con los subtítulos superpuestos para comprobar la legibilidad y la sincronización.
Preguntas frecuentes
¿Puedo exportar en formatos distintos de SRT?
También está disponible texto plano (TXT). TXT contiene solo el cuerpo del texto, sin códigos de tiempo, lo que va bien para actas y transcripciones.
¿Se pueden separar los subtítulos por hablante?
Con la separación de hablantes activada, cada línea registra quién hablaba. Puedes renombrar hablantes y reasignar líneas concretas en pantalla.
¿Puedo corregir la sincronización si se desajusta?
Sí. Haz clic en el tiempo de una línea, o elige «Editar tiempos» en el menú «⋮», para volver a escribir su inicio y su fin en segundos (hasta centésimas). También puedes añadir o eliminar líneas, así que antes de exportar puedes insertar frases que el modelo omitió o quitar una línea espuria de un tramo en silencio.
¿En qué idiomas puedo generar subtítulos?
Se pueden seleccionar once idiomas —entre ellos español, inglés, japonés, chino y coreano— además de la detección automática. El modelo incluido es multilingüe, así que los idiomas fuera de la lista suelen funcionar con la detección automática.
Preparar el audio y el vídeo, y después de transcribir
Ayúdanos a mejorar el servicio
Enviarnos las circunstancias de una ejecución —con éxito o fallida— nos ayuda a encontrar los problemas (una tasa de fallos necesita ambas). Saber qué dispositivos y ajustes fallan más nos permite revisar los valores recomendados y corregir los errores. Si no te importa, dejarlo activado nos ayuda mucho.
Qué se envía
Las características del dispositivo (modelo de GPU, memoria, número de núcleos), el navegador y el sistema operativo, el modelo y el idioma elegidos, hasta dónde llegó el proceso, los detalles del error, el formato del archivo con su tamaño y duración aproximados, y cuánto tardó.
Qué no se envía nunca
El audio, las transcripciones, los nombres de archivo y las direcciones IP. Los datos van únicamente al servidor de este sitio, nunca a un servicio de terceros.