Cómo importar tu propia transcripción en Premiere Pro
Por Greg Thompson, Founder, CutConvertPublicado el Actualizado el
Los menús de los programas se citan en inglés, tal como aparecen en la interfaz.
Para importar una transcripción en Premiere Pro, abre la pestaña Transcript del panel Text y usa Import Static Transcript para una transcripción nueva con tiempos (JSON con tiempos por palabra) o Import Corrected Transcript para fusionar texto corregido sobre tiempos que Premiere ya tiene. Si ya tienes una transcripción de Rev, Otter, un documento de Word o un proveedor de subtitulado, no hace falta volver a ejecutar Speech to Text de Premiere y pagar los minutos — Premiere puede conectar una transcripción externa a la edición basada en texto, siempre que el archivo lleve los datos de tiempo que necesita.
La trampa es el formato. El panel de transcripción de Premiere no acepta un párrafo de texto plano y deduce los tiempos por ti. Espera o bien un JSON con código de tiempo por palabra, o bien un archivo de texto que coincida exactamente con el recuento de palabras de una transcripción existente. Esta guía cubre esas dos vías, cómo importar cada una y cómo sacar después un SRT.
¿Tienes la transcripción lista? Conviértela directamente al formato de importación de Premiere: SRT a JSON de Premiere para subtítulos, TXT a JSON de Premiere para exportaciones de Rev/Otter, o DOC a JSON de Premiere para documentos de Word — y usa Import Static Transcript como se explica abajo.
Qué es realmente la edición basada en texto
La edición basada en texto convierte la transcripción en tu superficie de montaje. En lugar de recorrer la línea de tiempo buscando una frase, lees la transcripción en el panel Text, seleccionas las palabras que quieres y Premiere monta el vídeo correspondiente en una secuencia. Borra una frase en la transcripción y el rango de clip equivalente sale del montaje.
Esto solo funciona porque cada palabra está anclada a un código de tiempo. Cuando Premiere transcribe un clip con Speech to Text, registra el inicio y la duración de cada palabra individual. Ese tiempo por palabra es lo que permite que una selección de texto se traduzca en puntos de entrada y salida sobre el material. Cualquier transcripción externa tiene que llevar ese mismo nivel de detalle, o la edición basada en texto no tiene contra qué mapear.
Qué es un archivo .prtranscript
.prtranscript es el formato propio de intercambio de transcripciones de Premiere. Al exportar una transcripción desde el panel Text (pestaña Transcript, menú Export), Premiere escribe un .prtranscript: un contenedor nativo que mueve una transcripción entre proyectos y equipos conservando tiempos por palabra y hablantes.
Es cómodo para mover una transcripción que ya existe dentro de Premiere. No es el formato que generas desde una herramienta externa, porque su estructura interna es un contenedor binario, no una especificación documentada. Para importar transcripciones externas, Adobe añadió un formato JSON aparte y documentado.
Static Transcript (JSON) frente a Corrected Transcript (TXT)
Hay dos maneras de meter texto externo en el panel, y resuelven problemas distintos.
- Import Static Transcript (JSON) es para una transcripción nueva con sus propios tiempos. Aportas un JSON que lista cada palabra con inicio y duración, y Premiere construye una transcripción completa sobre el clip. Es la vía que habilita la edición basada en texto desde una fuente externa.
- Import Corrected Transcript (TXT) es para corregir las palabras de una transcripción que ya existe en Premiere. Le das un
.txtplano y Premiere conserva los tiempos existentes mientras sustituye el texto. Úsalo cuando Speech to Text acertó los tiempos pero estropeó ortografía, puntuación o nombres propios.
La distinción importa: el JSON lleva tiempos, así que puede crear una transcripción. El TXT no lleva tiempos, así que solo puede corregir una que ya está ahí.
El requisito de tiempo por palabra y la especificación JSON de Adobe
Adobe publica una especificación JSON precisamente para que desarrolladores y montadores traduzcan otros formatos a algo que Premiere acepte. La idea central: el archivo es una lista de palabras, y cada entrada lleva su inicio en segundos desde el comienzo del audio y su duración en segundos, ambos como números decimales. Las etiquetas de hablante y los segmentos acompañan a las palabras.
Conceptualmente, una palabra tiene esta forma:
{
"text": "Hola",
"start": 12.480,
"duration": 0.320
}Un archivo real es una matriz ordenada de esos objetos (agrupados en segmentos, con hablantes) que cubre toda la duración del clip. Como los tiempos son por palabra y en segundos decimales — no en fotogramas — da igual la frecuencia de tu material; Premiere adapta los segundos a la base de tiempo del clip al importar.
Llevar un SRT o una exportación de Rev u Otter a esa forma exacta a mano es tedioso y propenso a errores — la razón entera de que exista un conversor. El conversor de SRT a JSON de Premiere toma un archivo de subtítulos estándar y emite la estructura JSON que espera la importación estática, distribuyendo los tiempos por palabra dentro del rango de cada subtítulo. Si tu origen es una transcripción plana, el conversor de TXT a JSON y el de DOC a JSON hacen lo mismo desde texto o Word.
Cómo importar una Static Transcript, paso a paso
- Abre el clip en el monitor de origen (doble clic en el panel Proyecto). La importación funciona de forma más fiable sobre el clip de origen que sobre una instancia en la secuencia.
- Abre el panel Text (Window > Text) y selecciona la pestaña Transcript.
- Pulsa el menú desplegable (el botón ... arriba de la pestaña).
- Elige Import > Import Static Transcript y selecciona tu JSON.
- Premiere lee los tiempos y construye la transcripción sobre el clip — lista para la edición basada en texto.
- Para corregir el texto después sin tocar los tiempos, vuelve al mismo menú y elige Import Corrected Transcript con un
.txtalineado con la transcripción existente.
Fusionar una transcripción corregida en Premiere Pro
«Merge with corrected transcript» es el nombre que da Premiere a lo que hace esta importación: fusiona tu texto corregido sobre los tiempos que ya almacena. Premiere recorre tu .txt y la transcripción existente en paralelo, emparejando posiciones de palabra, y sustituye el texto mientras cada palabra conserva su inicio y duración originales. No se retranscribe nada — solo cambian las palabras.
Si la opción aparece desactivada, tiene un significado concreto y una lista corta de arreglos — consulta la guía sobre Import Corrected Transcript desactivado (en inglés).
Como la fusión es posicional, solo funciona si tu texto corregido se mantiene cerca del original: mismas palabras en el mismo orden, con ortografía, puntuación y nombres propios corregidos. Si borras párrafos o reordenas secciones, Premiere pierde el mapeo a mitad de camino y vuelca el resto en un bloque sin tiempos. Si tu versión ha divergido de verdad, la fusión es la herramienta equivocada: conviértela a JSON con tiempos con el conversor de TXT a JSON e impórtala como Static Transcript nueva.
Convertir transcripciones de Rev, Otter, Word o SRT
La mayoría no empieza de cero, sino desde un archivo que ya produjo un proveedor. La conversión depende de lo que tengas:
- Un SRT o VTT: los subtítulos ya contienen rangos de tiempo, así que el conversor puede interpolar tiempos por palabra dentro de cada cue. Usa SRT a JSON de Premiere.
- Una transcripción plana (.txt) sin tiempos: pásala por TXT a JSON de Premiere. Sin código de tiempo en el origen, los tiempos se estiman.
- Un documento de Word (.doc/.docx): DOC a JSON de Premiere elimina el formato y produce el JSON.
- Una exportación nativa `.prtranscript`: reimpórtala directamente por el mismo menú; sin conversión.
Para el viaje inverso — sacar un archivo de subtítulos limpio de una transcripción de Premiere — usa el conversor de transcripción de Premiere a SRT.
Sacar un SRT de Premiere
Con la transcripción dentro de Premiere, exportar subtítulos pasa por los subtítulos, no por la transcripción en bruto:
- En el panel Text, abre la pestaña Captions.
- Elige Create captions from transcript, ajusta caracteres por línea, duración mínima y separaciones.
- Premiere genera una pista de subtítulos con los tiempos de la transcripción.
- Ve a File > Export > Captions y elige SRT.
Crea los subtítulos al final, desde una secuencia terminada, para que los saltos de línea y los tiempos correspondan a lo que realmente se entrega.
Preguntas frecuentes
¿Puedo importar un texto plano y que Premiere deduzca los tiempos? No. Un .txt plano solo funciona como transcripción corregida sobre un clip que ya tiene tiempos. Para crear una transcripción nueva con tiempos desde fuera de Premiere necesitas el formato JSON con tiempos por palabra, o ejecutar el propio Speech to Text de Premiere.
¿Qué diferencia hay entre .prtranscript y el formato JSON? .prtranscript es la exportación binaria nativa de Premiere para mover una transcripción entre proyectos. El formato JSON es la especificación documentada para introducir una transcripción externa en Premiere mediante Import Static Transcript.
¿Por qué mi transcripción corregida solo importa bien las primeras frases? Tu texto corregido se ha alejado del recuento de palabras del original, así que Premiere pierde la alineación y vuelca el resto en un solo bloque. Ajusta el texto corregido palabra por palabra al de la transcripción existente.
¿Tengo que igualar la frecuencia de fotogramas del proyecto en el JSON? No. La especificación expresa los tiempos en segundos decimales desde el inicio del audio, no en fotogramas, así que Premiere los adapta a la frecuencia del clip.
¿Qué significa «merge with corrected transcript» en Premiere Pro? Es la importación de transcripción corregida: Premiere fusiona tu texto corregido con los tiempos por palabra que ya almacena, emparejando posiciones entre tu .txt y la transcripción existente. Los tiempos nunca cambian — solo el texto.
¿Puedo importar un SRT directamente como transcripción en Premiere? Directamente no — Premiere importa SRT como subtítulos, y eso no habilita la edición basada en texto. Para usar subtítulos como transcripción, convierte el SRT a JSON de transcripción y usa Import Static Transcript.