Guía de subtítulos en directo para emisión y streaming
El punto de su cadena donde entran los subtítulos decide el formato, el retardo y el trabajo. Una guía clara de 608, WebVTT y TTML, con una lista de comprobación reutilizable.
La mayoría de los proyectos de subtitulado en directo empiezan con la pregunta equivocada. Los equipos preguntan qué proveedor o qué formato elegir. La pregunta que decide todo lo demás es más sencilla: ¿en qué punto de su cadena se unen los subtítulos al vídeo?
Responda primero a eso y el formato se elige solo. El retardo pasa a ser un ajuste en lugar de una sorpresa. Nadie tiene que instalar un equipo nuevo en el rack.
Si se la salta, descubrirá en la semana del lanzamiento que su empaquetador descarta la mitad del estilo, o que sus reproductores HLS nunca ven el 608 que le dijeron que tenía.
Esta guía es la referencia que nos gustaría que todos los equipos de emisión y streaming tuvieran antes de su primera emisión subtitulada. Explica cómo encaja el subtitulado en la nube en un flujo de trabajo que ya utiliza, qué son realmente los formatos, de qué dependen la precisión y el retardo, y termina con cinco preguntas y una lista de comprobación que puede reutilizar antes de cada emisión.
Los subtítulos se unen a su cadena en uno de cinco puntos
Toda cadena en directo tiene los mismos hitos: una señal de contribución, un transcodificador, un empaquetador, un origen y los reproductores. SyncWords se sitúa en una de cinco posiciones respecto a ellos, y cada posición abre un conjunto distinto de formatos.

- Antes del transcodificador. Su señal llega a SyncWords por SRT como MPEG-TS, y los subtítulos vuelven en el mismo transport stream. Esta es la ruta de emisión completa: EIA-608 incrustado, Teletexto (DVB-TXT), DVB-SUB y DVB-TTML, cada idioma en su propio PID etiquetado. Es adecuada para playout, contribución y cualquier cadena que termine en un multiplexor o en un enlace ascendente por satélite.
- Entre el transcodificador y el empaquetador. El transcodificador envía CMAF Ingest (o el más antiguo HLS Ingest) a SyncWords, que añade una pista de subtítulos TTML y pasa el flujo al empaquetador. Los equipos de AWS suelen situarse aquí, entre MediaLive y MediaPackage. El empaquetador convierte nuestro TTML a WebVTT, por lo que solo se conserva el estilo que ese empaquetador entiende.
- Después del empaquetador, en el origen. SyncWords lee su HLS existente y escribe segmentos WebVTT junto a él, sin copiar ni volver a publicar sus segmentos de vídeo. Los reproductores reciben casi toda la especificación WebVTT, lo que convierte esta posición en la que ofrece más opciones de estilo y colocación.
- RTMP. Las emisiones para redes sociales y live shopping apenas tienen transcodificador o empaquetador. Los subtítulos viajan con el flujo RTMP hacia destinos como YouTube Live y Facebook Live.
- El widget. Sin vídeo. Los espectadores abren un enlace o escanean un código QR y leen los subtítulos en su propio teléfono. Este es el producto para eventos, y basta con el audio.
Hay dos cosas que se cumplen en todas las posiciones. El vídeo nunca se transcodifica, de modo que la calidad de imagen, el DRM y los marcadores SCTE-35 pasan tal como llegaron. Y una misma sesión puede alimentar varias posiciones a la vez: SRT de vuelta a su playout y un enlace al widget para las personas presentes en la sala, a partir de los mismos subtítulos.
¿Trabaja en AWS? Cómo añadir subtítulos en directo a AWS MediaLive sin volver a codificar explica paso a paso la posición intermedia.
Conserve la infraestructura que ya tiene
El subtitulado en la nube no implica desmontar nada. Si ya dispone de un codificador de subtítulos por hardware, SyncWords puede controlarlo por IP con una señal 608, para que avance a su propio ritmo. Si sus subtituladores o su software de estenotipia ya producen una señal 608, podemos recibirla mediante una conexión directa Control-A y generar subtítulos a partir de ella. Y si su equipo lo automatiza todo, la API le permite asignar un servicio por canal una sola vez y, después, iniciarlo, detenerlo y programarlo sin volver a tocar la configuración.
Los formatos de subtítulos, explicados con claridad
Los formatos se dividen en dos familias. Unos viajan dentro de la señal de vídeo. Otros viajan como pistas de texto o de imagen independientes junto a ella.
EIA-608. También lo verá como CEA-608: es el mismo estándar, y el nombre cambió con el organismo de normalización. Es el formato norteamericano de la línea 21, nacido en la televisión analógica. Un juego de caracteres reducido, unas pocas filas de texto y cuatro canales de subtítulos (CC1 a CC4). Es lo que esperan la mayoría de los sistemas de playout, decodificadores y codificadores de subtítulos por hardware de Estados Unidos. Cubre los siete idiomas que admite el estándar, entre ellos inglés, español, francés, portugués e italiano.
CEA-708. El sucesor para la televisión digital, con más servicios, fuentes, colores y colocación de ventanas. El detalle que confunde a los equipos: los datos de subtítulos digitales transportan 608 en su interior por compatibilidad, y así es como SyncWords llega a una cadena 708. Nosotros escribimos EIA-608, y un sistema que espera 708 recibe nuestro 608 dentro de él. CEA-608 frente a 708: lo que los equipos de emisión deben saber explica qué significa esto para sus decodificadores.
WebVTT. El formato de pista de texto del streaming HLS. Un archivo sencillo de indicaciones temporizadas que el reproductor dibuja en pantalla, en su propio menú de subtítulos. Si sus espectadores ven el contenido en un navegador, una app o un reproductor de televisión conectada, esto es casi con toda seguridad lo que ven. JW Player, THEOplayer, HLS.js y Video.js lo muestran de forma nativa.
TTML. La familia de texto temporizado en XML. En streaming es la pista de subtítulos dentro de CMAF. Su perfil de emisión, DVB-TTML, es hacia donde se dirige el subtitulado europeo: posicionamiento preciso y estilos modernos, aunque la compatibilidad de los decodificadores todavía se está poniendo al día.
Teletexto y DVB-SUB. Los caballos de batalla de la emisión europea. El Teletexto (DVB-TXT) es el más compatible con los descodificadores que ya hay en los hogares, con un número de página por idioma. DVB-SUB envía cada subtítulo como un mapa de bits, de modo que cualquier decodificador puede mostrarlo sean cuales sean sus fuentes. Eso lo convierte en la opción fiable para árabe, cirílico, chino, japonés y otras escrituras no latinas.
La regla práctica: adapte el formato al último dispositivo que tiene que entenderlo. Una cadena de playout estadounidense necesita 608. Un reproductor HLS necesita WebVTT. Un descodificador europeo necesita Teletexto o DVB-SUB.
La precisión empieza en la ingesta
La precisión empieza en la ingesta. Con un audio de programa limpio y un diccionario ASR personalizado para sus nombres y su terminología, el subtitulado en directo ofrece una precisión de palabras de primer nivel. Como cada traducción se construye a partir de esa transcripción, la calidad del diccionario se traslada a cada idioma de subtítulos y de doblaje.
En la práctica, eso significa tres cosas.
- Envíe el audio de programa, no un micrófono de sala. En una fuente MPEG-TS puede elegir la pista de audio exacta por índice o por PID, e incluso canales concretos dentro de ella. Elija la mezcla limpia de comentarios o del presentador, no el ambiente del estadio.
- Cargue el diccionario antes de la emisión. Nombres de presentadores, plantillas de los equipos, patrocinadores, topónimos, siglas. Los diccionarios son ilimitados, pueden configurarse por defecto o por evento, y quedan asociados a un tipo de programa para que el programa de los martes no empiece de cero cada semana.
- Decida dónde debe intervenir una persona. El Caption Editor muestra los subtítulos de IA a un editor un número determinado de segundos antes de que los vean los espectadores, para que alguien pueda corregir un nombre en ese intervalo. Para las sesiones más importantes, se puede reservar un subtitulador CART humano a través de la misma plataforma.
Más información sobre dónde encaja el subtitulado con IA y dónde el humano: Del subtitulado en directo tradicional a la accesibilidad impulsada por IA. Y los motivos habituales por los que falla un evento subtitulado, casi ninguno de ellos técnico: Por qué falla el subtitulado de eventos en directo y cómo asegurarse de que el suyo no falle.
El retardo es un ajuste que usted elige
Hay tres palabras que se confunden en todas las conversaciones sobre subtitulado, y significan cosas distintas.
- La latencia es cuánto va el vídeo de salida por detrás del vídeo de entrada.
- El tiempo de procesamiento es lo que tarda la cadena de procesamiento en convertir la voz en un subtítulo.
- El retardo es lo que percibe el espectador: el subtítulo frente al audio que está oyendo.
El control entre ellas es el búfer. Si retiene el vídeo unos segundos, los subtítulos tienen tiempo de alcanzarlo y aparecen sin un retardo perceptible. Si mantiene el vídeo ajustado, acepta un breve desfase entre la voz y el subtítulo. Muchos equipos de emisión eligen la segunda opción.
Las cifras dependen de la posición. La ruta de vídeo en sí añade una latencia de medio segundo en los flujos SRT y, sin búfer, se obtiene un retardo de subtítulos inferior a 2 s en SRT. Las soluciones de subtitulado habituales muestran los subtítulos en directo en un plazo de 4 a 8 segundos. En el lado de HLS, los espectadores suelen ver los subtítulos unos 5 segundos por detrás del audio del programa en los flujos HLS.
Los subtítulos traducidos tardan más en producirse que los subtítulos en el mismo idioma, por lo que una emisión multilingüe necesita un búfer mayor. Lo dimensionamos con usted para cada canal. El artículo sobre subtítulos multilingües en directo trata ese aspecto.
Sus obligaciones, nuestra salida
Las cadenas y los organismos públicos subtitulan porque las normas lo exigen: el Título V de la FCC, la ADA, la Ley Europea de Accesibilidad (en vigor desde junio de 2025) y otras, según dónde emita. La salida de SyncWords está construida según los criterios del Título V de la FCC en cuanto a precisión, sincronía, integridad y colocación, y le ayuda a cumplir las obligaciones de accesibilidad que le corresponden. El cumplimiento en sí recae en la cadena; nuestra salida está construida para respaldarlo.
La colocación es el criterio que los equipos olvidan. En 608 se configuran la fila y el número de líneas. En Teletexto se configura la fila y se puede usar doble altura. En DVB-SUB, WebVTT y DVB-TTML se configura el margen inferior. Utilice estos controles para mantener los subtítulos alejados de los rótulos y los marcadores antes de la primera emisión, no después de la primera queja.
Cinco preguntas antes de subtitular una emisión en directo
1. ¿Qué formato de subtítulos necesita cada destino? Enumere todos los destinos: playout, app OTT, reproductor web, redes sociales. Anote junto a cada uno el formato que lee. Esa lista le indica qué posición necesita y si una sesión debe alimentar más de un destino.
2. ¿Quién revisa el diccionario personalizado de nombres y términos? Asígnele un responsable. Normalmente, el productor o la persona que redacta la escaleta. Un diccionario sin responsable queda desactualizado al tercer programa.
3. ¿En qué idiomas ve realmente su audiencia? Consulte sus analíticas, no sus ambiciones. Empiece por los dos o tres idiomas que muestran los datos y añada más cuando vea que se utilizan.
4. ¿Cómo llegarán los subtítulos a todas las plataformas en las que emite? Una sesión puede entregar en varios lugares a la vez, y cada método de entrega transporta todos los idiomas activos. Confirme que cada plataforma recibe los subtítulos en un formato que acepta antes del día de la emisión, no durante.
5. ¿Quién supervisa los subtítulos durante la emisión? Alguien debería estar viendo la salida en el reproductor o decodificador real, con una forma de contactar con el soporte. El soporte de SyncWords funciona 24/7 y, en los eventos, un técnico se une a la sesión en directo.
La lista de comprobación previa a la emisión
Imprímala, péguela en su manual de operaciones y reutilícela cada vez.

Una semana antes
- [ ] Destinos y sus formatos enumerados, posición acordada
- [ ] Idiomas elegidos a partir de los datos de audiencia
- [ ] Diccionario cargado con nombres, términos y siglas, y un responsable designado
- [ ] Búfer acordado: vídeo ajustado con un breve retardo de los subtítulos, o unos segundos de búfer y ningún retardo perceptible
- [ ] Servicio creado y programado, para que empiece a tiempo sin nadie al teclado
El día anterior
- [ ] Prueba de extremo a extremo en el decodificador, reproductor o destino social real, no en una ventana de vista previa
- [ ] Colocación de los subtítulos comprobada frente a rótulos y gráficos
- [ ] Etiquetas de idioma comprobadas en el menú del reproductor o en el selector del descodificador
- [ ] Pista de audio de programa confirmada: la mezcla limpia, a un nivel adecuado
- [ ] Ruta de conmutación por error confirmada
En antena
- [ ] Una persona vigilando los subtítulos en la salida que ve el espectador
- [ ] Caption Editor abierto si los nombres o las cifras deben ser exactos
- [ ] Contacto de soporte a mano
Después de la emisión
- [ ] Transcripción corregida y archivo VTT recogidos (se generan automáticamente al terminar la sesión)
- [ ] Nombres mal reconocidos añadidos al diccionario para la próxima vez
Siguientes pasos
Esta guía es el punto central. Tres artículos de este mes profundizan en las preguntas anteriores:
- Cómo añadir subtítulos en directo a AWS MediaLive sin volver a codificar, para equipos que trabajan con AWS Elemental
- CEA-608 frente a 708: lo que los equipos de emisión deben saber, para quienes tengan decodificadores que piden 708
- Una señal en directo, muchos idiomas, para añadir subtítulos traducidos al mismo flujo
Para el transporte que sustenta la mayoría de los flujos de emisión, consulte Secure Reliable Transport (SRT): el protocolo que impulsa las emisiones en directo de baja latencia.
¿Quiere ver los subtítulos sobre su propia señal, en la posición que encaja con su cadena? Reserve una demo: reserve una demo
Vea los subtítulos sobre su propia señal
Reserve una demo