Skip to content

ENMA 2023 — Base de datos v2

Choose a tag to compare

@natdebandi natdebandi released this 17 Sep 21:04
· 3 commits to main since this release

Base de datos de la Encuesta Nacional Migrante de Argentina, edición 2023, en versión de acceso abierto. Esta versión reemplaza a la publicada como datos-v1.

Contenido. 4.679 casos y 227 variables, con una fila por persona encuestada. De las variables, 215 corresponden a las preguntas del cuestionario y 12 son elaboradas para el análisis, entre ellas las agrupaciones de género, edad, nacionalidad, región, nivel educativo y tiempo de residencia, una tipología de circuitos laborales y los dos ponderadores.

Qué cambia respecto de datos-v1. Se retira la columna q5_descendencia_otro_descrip, que reunía 155 descripciones de ascendencia redactadas a mano, de las cuales 134 aparecen una sola vez. La regla de anonimización con que se generó la versión anterior medía el porcentaje de valores distintos sin descontar el rótulo de relleno de la opción abierta, de modo que esa columna quedaba por debajo del umbral y sobrevivía a la limpieza. El resto de la base es idéntico: la versión nueva coincide con la anterior celda por celda en las 227 columnas comunes, en el mismo orden. Los resúmenes criptográficos de la versión sustituida constan en el informe técnico del repositorio, junto con el detalle de la corrección.

Qué cubre. Once secciones: información general; trayectorias y proyecto migratorio; situación documentaria; situación familiar y hogar; hijes y educación; derecho a la salud; vivienda; trayectoria educativa; situación socioeconómica; discriminación y violencia; y participación social y política. Las preguntas de selección múltiple se presentan desplegadas, con una columna indicadora por opción.

Antes de tabular, tres cosas.

  1. Los dos ponderadores no son intercambiables. weightvec va en toda estimación sobre el total de la base. weightvec_0 sirve únicamente para analizar al interior de las diez nacionalidades más numerosas; para cualquier otra, el documento metodológico recomienda no ponderar y trabajar en valores absolutos.
  2. Hay dos formas de valor ausente. La cadena NA es pregunta no respondida y la celda vacía es pregunta que no correspondía por filtro. Conviene declarar las dos al importar.
  3. La muestra es representativa a nivel de las seis regiones de residencia, no por provincia, y no es representativa en edades simples.

La documentación completa está en documentacion/BASE_enma2023.md, e incluye la composición de la muestra, el diccionario por secciones, las advertencias de uso y ejemplos de lectura en R y en Python.

Código. Los ocho capítulos del Anuario Migratorio Argentino 2024 en R Markdown están en el repositorio y sirven de punto de partida para otras explotaciones: https://github.com/natdebandi/ENMA

Qué no incluye. Identificadores directos, geografía por debajo de la región y campos de texto libre. Quien requiera los microdatos completos puede solicitarlos a la fuente en https://www.encuestamigrante.ar/

Fuente. La ENMA se desarrolla desde la Red de Investigaciones en Derechos Humanos del CONICET en conjunto con más de 55 organizaciones de migrantes, con un enfoque práctico de derechos humanos. La encuesta se diseñó promoviendo la igualdad y el respeto de las personas migrantes; todo uso opuesto a ese objetivo, así como cualquier intento de reidentificación, resulta contrario al propósito con que fue producida.

Cómo citar.

ENMA 2023 (06/2024). Encuesta Nacional Migrante de Argentina 2023 [Base de datos]. Recuperado de https://encuestamigrante.ar/

Encuesta Nacional Migrante de Argentina (2026). ENMA 2023. Base de datos, versión 2 [Conjunto
de datos]. https://github.com/natdebandi/ENMA/releases/tag/datos-2023-v2

La cita de esta versión no reemplaza la de la encuesta como fuente primaria. Para los resultados
publicados en el Anuario Migratorio Argentino corresponde citar el anuario de la edición correspondiente.

Licencia. Creative Commons Atribución 4.0 Internacional. Integridad verificable contra SHA256SUMS.txt.