Introducción

El proceso de estimación automática de subidas por paradero tiene como objetivo disponer de información temprana sobre la demanda observada en el sistema de transporte público, utilizando como fuente principal las validaciones de pago y los registros GPS de los buses. A partir de estos datos, el sistema estima el punto de subida más probable de cada validación y genera una tabla agregada de subidas por paradero, servicio, periodo y otros atributos operacionales.

Este proceso se diferencia de los procedimientos consolidados de estimación de demanda porque opera con un desfase reducido respecto del día de operación. En particular, la ejecución automática considera el procesamiento de los datos correspondientes al día ubicado cuatro días antes de la fecha actual. Este desfase permite contar con información de demanda en plazos más breves, lo que resulta especialmente útil para monitoreo operacional, revisión de cambios recientes, análisis de comportamiento de usuarios y apoyo a decisiones de corto plazo.

Para lograr esto, el sistema se alimenta de distintos procesos automáticos de captura y estandarización de datos. Por una parte, existe un proceso que extrae los datos GPS en línea desde el web server del DTPM, los transforma a un formato estándar y los almacena como archivos diarios con registros únicos. Por otra parte, existe un proceso equivalente para las validaciones de pago, que estandariza la información transaccional y la organiza en archivos diarios. Adicionalmente, para cada día a procesar se descarga el programa de operación vigente desde el FTP dispuesto por el DTPM, el cual contiene la información necesaria para relacionar servicios, sentidos, recorridos y secuencias de paraderos.

Con estas fuentes de información, un módulo de procesamiento desarrollado en C++ realiza la estimación de la subida según el modo de transporte y la disponibilidad de datos. En Metro y MetroTren, la subida se obtiene directamente a partir de la estación donde se realizó la validación. En zonas pagas, se utiliza la ubicación del punto de validación y una distribución precalculada para asignar las validaciones a los servicios correspondientes. En buses, el sistema estima la posición del vehículo al momento de la validación mediante interpolación entre los registros GPS anterior y posterior, para luego asociar dicha posición al paradero más probable.

Cuando la validación de bus cuenta con servicio y sentido identificados, la búsqueda del paradero se realiza sobre la secuencia correspondiente a dicho servicio-sentido. Cuando esta información no está disponible, el sistema aplica una estrategia alternativa, buscando el paradero más cercano dentro de la red que sea coherente con la dirección de avance observada en los GPS. De esta forma, el proceso busca mantener cobertura de estimación incluso en casos donde la información operacional de la validación es incompleta.

El resultado final corresponde a una tabla agregada de subidas estimadas por fecha, tipo de día, paradero, comuna, modo, contrato, tipo de pago, servicio, periodo y media hora. Esta información permite analizar la demanda con un nivel de detalle suficiente para apoyar decisiones operacionales, identificar puntos de alta concentración de usuarios, revisar patrones temporales y observar variaciones recientes en el comportamiento del sistema.

Dado que este proceso utiliza datos tempranos, los resultados deben interpretarse como una estimación preliminar. La ventaja principal es la oportunidad de la información, ya que permite contar con resultados pocos días después de la operación. Sin embargo, al trabajar con datos que aún pueden no estar completamente consolidados, se estima que la cobertura de las fuentes de entrada se encuentra cercana al 95%. Por esta razón, los resultados son especialmente adecuados para monitoreo y análisis temprano, mientras que para reportes finales o análisis oficiales se recomienda utilizar versiones consolidadas cuando estas se encuentren disponibles.