Metodología de recopilación de datos de ITJTT

Metodología de recopilación de datos y definiciones de métricas de ITJTT

Último conjunto de datos verificado: 2026-08-18, zona horaria Asia/Bangkok

Origen de los datos

ITJTT recopila anuncios públicos de empleo de TI descubiertos por el sistema en JobsDB y crea snapshots diarios. Los datos de las páginas públicas proceden de una analytics API de solo lectura y de los índices de snapshots, y no se cuentan directamente desde la cache del modelo.

Frecuencia de actualización y zona horaria

El pipeline se ejecuta cada día, de forma predeterminada a las 00:10 en la zona horaria Asia/Bangkok. La fecha de los datos (data_date) es la fecha del snapshot diario, mientras que last_updated es la hora en que finalizó el procesamiento. El sitio web usa una cache temporal y comprueba si hay datos nuevos aproximadamente cada hora, pero siempre muestra la fecha real del snapshot y no denomina a los datos «en tiempo real».

Definiciones del recuento de empleos

jobs_analyzed
Número total de filas de anuncios que el sistema pudo analizar, utilizando el valor mayor entre las filas guardadas y los anuncios declarados por la fuente. No debe interpretarse como el número de empleos empresariales únicos.
unique_job_id
Número de identificadores de empleo únicos del sitio web de origen después de agrupar las filas de anuncios que hacen referencia al mismo identificador.
unique_business_job
Número de empleos empresariales únicos después de deduplicar anuncios que podrían corresponder al mismo puesto. Esta es la métrica predeterminada de las páginas públicas para roles, empresas, habilidades y tendencias.

Normalización y deduplicación

El sistema agrupa los nombres de roles, requisitos, lenguajes de programación y empresas bajo nombres canónicos para poder comparar los totales. Después distingue entre filas de anuncios, identificadores de empleo de origen y empleos empresariales únicos. Un empleo puede tener varios roles y varias habilidades, por lo que la suma de las categorías puede superar la cantidad de empleos.

Proporciones y medias móviles de 30 días

Proporción de empleos por rol
Número de empleos empresariales únicos clasificados en un rol canónico, dividido por el número total de empleos empresariales únicos del snapshot del mismo día. Un empleo puede tener varios roles, por lo que la suma puede superar el 100 %.
Proporción de empleos en los que aparece la habilidad
Número de empleos empresariales únicos en los que aparece ese lenguaje de programación o tecnología, dividido por el número total de empleos empresariales únicos del mismo snapshot. Un empleo puede tener varias habilidades.
Proporción media móvil ponderada de 30 días
Suma de los recuentos del elemento en los snapshots diarios de un periodo de 30 días, dividida por la suma de los empleos empresariales únicos de esos mismos días. Esta métrica se muestra cuando hay al menos 21 snapshots válidos.
Cambio, en puntos porcentuales (pp)
Diferencia entre la proporción media ponderada de los últimos 30 días y la del periodo anterior no superpuesto de 30 días; no es una tasa de variación porcentual relativa.

Las fechas sin snapshot se consideran datos ausentes, no cero. Sin embargo, los elementos que no aparecen en un snapshot válido pueden contarse como cero. Los cálculos usan la fecha del conjunto de datos en la zona horaria Asia/Bangkok y solo se redondean para su presentación.

Limitaciones y calidad de los datos

Concise English summary

ITJTT aggregates daily observations from publicly discoverable IT job postings in Thailand. Public pages default to deduplicated unique business jobs. Counts are observations within ITJTT coverage, not a complete census of Thailand's job market. Dates use the Asia/Bangkok timezone.