41. Tipos de muestreo

El método de selección determina qué unidades pueden formar parte de la muestra y qué tan defendible es generalizar los resultados a la población.

41.1 Clasificación general

Los métodos de muestreo se dividen en probabilísticos y no probabilísticos. En los probabilísticos se conoce o puede calcularse la probabilidad de selección de cada unidad. En los no probabilísticos la selección depende de la disponibilidad, el criterio del investigador o una condición práctica.

La elección debe responder al objetivo, la población, el marco muestral, el presupuesto y la precisión requerida.

41.2 Muestreo aleatorio simple

Todas las unidades tienen la misma probabilidad de ser elegidas y todas las muestras posibles de un tamaño dado tienen la misma oportunidad. Se implementa numerando la población y seleccionando identificadores sin reemplazo.

VentajaEs sencillo y fácil de analizar.
LimitaciónRequiere un marco muestral completo.
UsoConviene en poblaciones accesibles y relativamente homogéneas.

41.3 Muestreo sistemático

Se elige un inicio aleatorio y luego cada k-ésima unidad de una lista. Si la población tiene N elementos y se desea una muestra de n, se usa aproximadamente k = N/n.

N = 1000, n = 100 → k = 10. Se elige un inicio entre 1 y 10 y luego cada décima unidad.

Hay que revisar que la lista no tenga una periodicidad que coincida con k.

41.4 Muestreo estratificado

La población se divide en estratos internamente parecidos según una característica relevante, como región, edad o tipo de cliente, y se extrae una muestra dentro de cada estrato.

Puede ser proporcional, manteniendo el peso de cada grupo, o no proporcional, dando más observaciones a grupos pequeños que se desea analizar por separado.

41.5 Muestreo por conglomerados

La población se divide en grupos naturales llamados conglomerados, como escuelas, sucursales o barrios. Se seleccionan algunos grupos y se estudian todas sus unidades o una muestra dentro de ellos.

Es útil cuando no existe una lista individual completa, pero sí una lista de grupos. Puede ser menos preciso si las unidades de un mismo conglomerado son muy parecidas.

41.6 Estratos y conglomerados

CaracterísticaEstratificadoConglomerados
SelecciónSe toma muestra de cada estrato.Se seleccionan algunos grupos.
Dentro de los gruposSe busca homogeneidad.Se espera diversidad parecida a la población.
Objetivo frecuenteGarantizar representación.Reducir costos logísticos.

41.7 Laboratorio interactivo

Comparar métodos de selección

41.8 Muestreo por cuotas

Fija cantidades de participantes para ciertas categorías, pero permite elegir dentro de ellas por conveniencia o criterio del encuestador. Puede parecerse al estratificado en su distribución, pero no ofrece necesariamente probabilidades conocidas de selección.

41.9 Muestreo de conveniencia

Se eligen las unidades más fáciles de contactar: personas cercanas, usuarios disponibles o registros que ya están a mano. Es rápido y barato, pero puede representar mal a la población.

Es útil para exploraciones iniciales o pruebas de funcionamiento, no como evidencia automáticamente generalizable.

41.10 Muestreo voluntario

Participan quienes deciden responder a una invitación. Puede aparecer sesgo de autoselección porque las personas con opiniones fuertes o mayor interés responden con más frecuencia.

Una gran cantidad de respuestas voluntarias no elimina necesariamente ese sesgo.

41.11 Muestreo multietápico

Combina varias etapas: por ejemplo, se eligen regiones, luego escuelas dentro de cada región y finalmente estudiantes dentro de cada escuela.

Reduce costos, pero el análisis debe considerar las etapas y las probabilidades de inclusión para no subestimar la incertidumbre.

41.12 Con y sin reemplazo

En el muestreo sin reemplazo, una unidad no puede volver a aparecer. En el muestreo con reemplazo, se devuelve a la población y puede ser seleccionada otra vez.

Para encuestas de personas suele usarse sin reemplazo; en simulaciones puede ser útil el reemplazo.

41.13 Cómo elegir el método

  1. Definir la población objetivo.
  2. Revisar el marco muestral disponible.
  3. Identificar subgrupos importantes y fuentes de sesgo.
  4. Comparar costos, tiempo y precisión.
  5. Documentar el procedimiento y las unidades no contactadas.

41.14 Probabilidad de inclusión

En diseños probabilísticos, cada unidad tiene una probabilidad conocida o calculable de formar parte de la muestra. Si esas probabilidades son diferentes, el análisis puede necesitar ponderaciones.

Peso básico = 1 / probabilidad de inclusión

Los pesos permiten que unidades seleccionadas con menor probabilidad representen a más elementos de la población.

41.15 Implementación en JavaScript

Este ejemplo implementa un muestreo aleatorio simple sin reemplazo y dibuja la población y los elementos seleccionados. La función puede reutilizarse con cualquier arreglo.

const poblacion = Array.from({ length: 30 }, (_, indice) => indice + 1);
const tamanoMuestra = 8;
const disponibles = [...poblacion];
const muestra = [];

while (muestra.length < tamanoMuestra) {
  const indice = Math.floor(Math.random() * disponibles.length);
  muestra.push(disponibles.splice(indice, 1)[0]);
}

console.log('Población:', poblacion);
console.log('Muestra aleatoria:', muestra.sort((a, b) => a - b));

if (typeof document !== 'undefined') {
  const canvas = document.getElementById('canvasTiposMuestreoCodigo');
  const contexto = canvas.getContext('2d');
  const posicion = valor => 45 + (valor - 1) / 29 * 730;
  contexto.clearRect(0, 0, canvas.width, canvas.height);
  contexto.strokeStyle = '#aaca94'; contexto.lineWidth = 2;
  contexto.beginPath(); contexto.moveTo(45, 225); contexto.lineTo(775, 225); contexto.stroke();
  contexto.fillStyle = '#c7dfb8';
  poblacion.forEach(valor => { contexto.beginPath(); contexto.arc(posicion(valor), 225, 7, 0, Math.PI * 2); contexto.fill(); });
  contexto.fillStyle = '#5b8f29';
  muestra.forEach(valor => { contexto.beginPath(); contexto.arc(posicion(valor), 225, 11, 0, Math.PI * 2); contexto.fill(); });
}

41.16 Errores frecuentes

  • Llamar aleatoria a una selección por comodidad.
  • Confundir estratos con conglomerados.
  • Usar cuotas y afirmar que las probabilidades son conocidas.
  • Ignorar la periodicidad de una lista en un muestreo sistemático.
  • Olvidar la no respuesta y la cobertura incompleta.
  • Generalizar una muestra voluntaria sin advertencias.

41.17 Qué debes recordar

No existe un único método mejor para todos los problemas.
El aleatorio simple es una referencia, el sistemático simplifica listas, el estratificado asegura subgrupos, los conglomerados reducen costos y los métodos no probabilísticos deben comunicar sus limitaciones.

41.18 Conclusión

Elegir un tipo de muestreo conecta la pregunta del estudio con los datos disponibles. Un buen diseño hace explícita la población, la selección, las probabilidades de inclusión y las limitaciones de generalización. La programación ayuda a reproducir el procedimiento y visualizar sus consecuencias.