Paquete de Replicación para: Validez Concurrente de Test Cortos de Desarrollo Infantil

Por Health, Nutrition and Population Division (VPS/SCL/HNP)

Este conjunto de datos reúne información transversal sobre los resultados del desarrollo infantil, junto con las características de los niños y de sus padres y las condiciones del hogar, en una muestra de 1.311 niños de Bogotá, Colombia con edades de 6 a 42 meses, pertenecientes a hogares de ingresos bajos y medios-bajos.

Los datos sirvieron de base al estudio “Concurrent Validity and Feasibility of Short Tests Currently Used to Measure Early Childhood Development in Large Scale Studies”, firmado por Marta Rubio‑Codina, M. Caridad Araujo, Orazio Attanasio, Pablo Muñoz y Sally Grantham‑McGregor (de próxima aparición en PLOS ONE).

Gracias a este conjunto de datos es posible replicar los resultados del estudio, que recurre a instrumentos como la prueba Bayley y otras herramientas habituales para medir el desarrollo en la primera infancia. A partir de estos indicadores se pueden fijar puntos de referencia —por ejemplo, las puntuaciones promedio de desarrollo en Colombia— y comprender mejor el bienestar de la población infantil más pequeña de Bogotá.

  1. Enfoque: Desarrollo en la primera infancia (de 6 a 42 meses)
  2. Ubicación: Bogotá, Colombia
  3. Tamaño de la muestra: 1.311 niños
  4. Indicadores: Evaluaciones del desarrollo, características familiares y entorno del hogar
Mostrar más

Metadatos y uso

Identificador https://doi.org/10.60966/n2y42g0v
Licencia Creative Commons Atribución–NoComercial–SinObraDerivada 3.0 IGO
Producto de Conocimiento Relacionado
Citación

Rubio-Codina, Marta (2016). Paquete de Replicación para: Validez Concurrente de Test Cortos de Desarrollo Infantil. Datos Abiertos del BID. https://doi.org/10.60966/n2y42g0v

Fecha de publicación 2016-10-08
Fecha de modificación 2026-08-26
Etiquetas/Palabras Clave Desarrollo infantil
Idioma
  1. Inglés
Cobertura Temporal 2011-2011
País
Colombia
Región América Latina y el Caribe
Publicador
Banco Interamericano de Desarrollo
Autor
Rubio-Codina, Marta
Tipo de Recolección de Datos Datos de Encuesta
Tipo Estadístico Datos de Corte Transversal
Estructura de los Datos Datos Estructurados
Notas de datos

¿Qué es la prueba Bayley empleada en este conjunto de datos?

Las Escalas Bayley de Desarrollo Infantil (Bayley-III) constituyen una evaluación estandarizada del desarrollo temprano. Abarcan los dominios Cognitivo, Lenguaje y Motor y entregan puntuaciones compuestas normalizadas en torno a una media de 100 y una desviación estándar (DE) de 15. En este conjunto de datos, la Bayley-III se aplicó en paralelo con pruebas cortas (ASQ-3, Denver, Battelle, MacArthur) con el fin de analizar la validez concurrente en una muestra de Bogotá.

¿A quiénes se evaluó y en qué momento?

  • Tamaño de la muestra: 1.311 niños
  • Ubicación: Bogotá, Colombia (hogares de ingresos bajos y medios-bajos)
  • Rango de edad: 6 a 42 meses (mediana de 24 meses)
  • Diseño del estudio: Trabajo de campo transversal asociado al artículo sobre la validez concurrente de pruebas cortas en estudios a gran escala (Banco Interamericano de Desarrollo, BID; datos de campo de 2011 y guía del conjunto de datos fechada en agosto de 2016).

¿Cuáles son las puntuaciones promedio de desarrollo (muestra de Colombia) en la prueba Bayley?

En el total de la muestra (n=1.311), las medias de las puntuaciones compuestas de la Bayley-III fueron las siguientes: - Cognitivo: 98,4 (DE 8,9)
- Lenguaje: 96,5 (DE 9,9)
- Motor: 99,5 (DE 10,8)

Recordatorio: En la muestra de normalización de referencia, las puntuaciones compuestas de Bayley se escalan a una media de 100 y una DE de 15. La distribución observada en Bogotá responde a esta población de estudio concreta y a su composición por edades.

¿El conjunto de datos abarca pruebas distintas de la prueba Bayley?

Sí. Tanto las variables como los scripts incluidos en el paquete reflejan mediciones concurrentes provenientes de: - ASQ-3 (Ages & Stages Questionnaires)
- Denver (Denver Developmental Screening)
- Battelle
- MacArthur (CDI)
De este modo es posible contrastar las pruebas cortas con la Bayley-III en los análisis de validez concurrente.

¿De qué manera conviene interpretar las puntuaciones compuestas de Bayley?

  • El valor 100 corresponde a la media normativa; cada 15 puntos representan una desviación estándar.
  • Las puntuaciones de 85 a 115 quedan dentro de aproximadamente ±1 DE respecto de la media normativa.
  • Por debajo de 85, las puntuaciones apuntan a posibles retrasos del desarrollo y aconsejan seguimiento clínico; a partir de 115 señalan un desempeño superior al promedio. Toda interpretación debe ponderar la edad, las condiciones de la prueba, el idioma de aplicación y el contexto socioeconómico.

¿Hay puntos de referencia urbanos o nacionales con los que contrastar estos resultados de Bogotá?

El conjunto de datos se concibió para evaluar la validez concurrente entre instrumentos, no para fijar puntos de referencia oficiales a escala urbana o nacional. Si desea establecerlos, dispone de dos caminos: - Tomar como contraste las normas de la Bayley-III (media 100, DE 15), o bien
- Elaborar, a partir de esta muestra, tablas de referencia de Bogotá específicas por edad, con las ponderaciones y los intervalos de confianza que correspondan.

¿Qué otros recursos se incluyen para apoyar a los investigadores?

  • Una guía en PDF que detalla el estudio, las mediciones y la organización de los archivos.
  • Varios do-files para generar tablas de correlación, errores estándar mediante bootstrap y pruebas de diferencias en la validez concurrente.
  • Un archivo de datos unificado (tests-bogota) que reúne 311 variables: los dominios de Bayley, las puntuaciones de las pruebas cortas y numerosas covariables del niño y del hogar.

¿Qué limitaciones presenta el conjunto de datos?

  • Representatividad de la muestra: Al centrarse en una población urbana concreta de Bogotá, su generalización a contextos rurales o nacionales resulta limitada.
  • Rango de edad: Cubre una franja etaria acotada (en general bebés y niños pequeños), de modo que no se presta al análisis más amplio del desarrollo infantil o adolescente.
  • Adaptación de las pruebas: Las versiones cortas se ajustaron para hacer viable la investigación, lo que sacrifica algo de precisión psicométrica frente a la escala Bayley completa.
  • Diseño transversal: Como los datos retratan un único momento, el conjunto no permite medir trayectorias de desarrollo a largo plazo ni efectos causales.

¿Qué tipo de decisiones de política pública puede respaldar este conjunto de datos?

  • Diseño de la medición en la primera infancia: Los responsables de políticas pueden apoyarse en los hallazgos para validar herramientas más breves y económicas en las encuestas nacionales, lo que amplía la recopilación de datos a un menor costo.
  • Focalización de intervenciones tempranas: Los hallazgos orientan a los programas de desarrollo de la primera infancia (DPI) a la hora de detectar poblaciones en riesgo mediante instrumentos de cribado eficientes.
  • Evaluación de programas: Al garantizar medidas de resultado válidas y escalables, los resultados favorecen una mejor evaluación de impacto de las intervenciones de aprendizaje temprano y de crianza.
  • Estandarización de las métricas de desarrollo: Los datos nutren los esfuerzos regionales por armonizar los estándares de medición del DPI en toda América Latina.

¿Qué son las Escalas Bayley de Desarrollo Infantil?

Las Escalas Bayley se reconocen como la prueba diagnóstica de referencia (gold standard) para medir el nivel de desarrollo de bebés y niños pequeños. Examinan varios dominios —entre ellos la cognición, el lenguaje y las habilidades motoras— y gozan de amplio uso en entornos de investigación controlada y en la práctica clínica. En el estudio de Bogotá, psicólogos capacitados aplicaron la Bayley-III en entornos estandarizados.
"Multi-dimensional diagnostic tests such as the Bayley Scales of Infant Development are considered to be the 'gold standard' to measure the developmental levels of infants and toddlers."

¿Cuánto dura una evaluación Bayley y en qué consiste?

La Bayley-III se aplicó en bibliotecas públicas o centros de cuidado infantil, por lo común en una sesión dedicada a cargo de psicólogos capacitados. Cada niño se evaluó de forma individual en espacios tranquilos y bien iluminados, con la presencia de sus cuidadores. El conjunto de datos advierte que aplicar la Bayley-III lleva bastante tiempo y exige formación especializada.
"Test administration is time consuming and requires highly trained professionals working in controlled environments."

Escalas Bayley frente a ASQ-3: ¿cuál cribado del desarrollo conviene más?

Según el conjunto de datos, el ASQ-3 rinde poco por debajo de los 31 meses, mientras que el Denver-II exhibe una validez más sólida. En los menores de 19 meses, las escalas cognitiva, de lenguaje y de motricidad fina del ASQ-3 mostraron baja validez concurrente con la Bayley-III.
"Overall, the Denver-II seems the most feasible and valid multi-dimensional test and the ASQ-3 performs poorly under 31 months."

¿Cuán fiables son las Escalas Bayley para detectar el retraso del desarrollo y qué validez tienen?

El conjunto de datos ratifica que la Bayley-III es el patrón de referencia y que detecta las diferencias en los resultados atribuibles a las intervenciones. Por ello se empleó como base para las comparaciones de validez concurrente.
"Importantly, this test has shown sensitivity to differences in ECD outcomes due to interventions in diverse contexts."

Archivos del conjunto de datos

Cargar más

Materiales adicionales

Cargar más