Preguntas de entrevista
Preguntas de entrevista para analistas de datos
Practica preguntas de entrevista para analistas de datos sobre SQL, métricas, casos analíticos, paneles, Excel, experimentación, calidad de datos y comunicación con stakeholders. Utiliza esta selección junto con la guía completa de Guía para entrevistas de analista de datos.
18 preguntas
7 categorías
Analista de datos
Actualizada en mayo de 2026
Preguntas de entrevista sobre SQL
Practica preguntas empresariales realistas sobre usuarios, pedidos, eventos, suscripciones, retención, ingresos y embudos.
Enfoque — Filtrar → Unir → Agrupar → Ordenar → Limitar
Primero aclaro si se cuentan pedidos cancelados o reembolsados; normalmente solo incluyo los completados. La consulta filtra orders por fecha y estado, agrupa por cliente, suma revenue, ordena de mayor a menor y limita a cinco. Importan la fecha correcta y la granularidad. Los datos de líneas deben preagregarse para no multiplicar ingresos. Si deben incluirse empates en el quinto puesto, utilizo una función de ranking en lugar de LIMIT. Por último valido el total elegible, los recuentos y posibles duplicados.
Posibles preguntas de seguimiento
¿Cómo incluirías empates en el quinto puesto?
¿Qué cambia si los ingresos están a nivel de línea?
¿Cómo excluirías reembolsos?
Enfoque — Definir cohorte → Definir retorno → LEFT JOIN → Agregar
Primero defino retención: actividad exactamente en el séptimo día o en cualquier momento durante los siete primeros. Para Day 7, un CTE contiene las altas de enero con user_id y signup_date, y un LEFT JOIN conecta los eventos válidos del séptimo día. El LEFT JOIN conserva a quienes no volvieron; un INNER JOIN inflaría la tasa. El denominador son usuarios únicos elegibles y el numerador quienes tienen el evento. Excluyo del denominador a usuarios sin siete días completos de observación. También puedo segmentar por canal, plataforma, región o semana.
Posibles preguntas de seguimiento
¿En qué se diferencian Day 7 y Rolling 7-Day?
¿Cómo tratas a usuarios con menos de siete días observables?
¿Qué eventos cuentan como actividad?
Enfoque — Numerar compras por usuario
Filtro primero compras válidas y completadas. Después las numero con row_number() over (partition by user_id order by purchase_at, order_id) y selecciono la fila de rango dos. order_id hace el resultado determinista cuando coinciden las marcas de tiempo. Si deben aparecer todos los usuarios, uno el resultado con la tabla de usuarios mediante LEFT JOIN; quien no tenga segunda compra conserva un valor nulo. En tablas grandes, ayudan índices sobre user_id y fecha de compra.
Posibles preguntas de seguimiento
¿Cómo mostrarías usuarios sin segunda compra?
¿Qué ocurre con marcas de tiempo idénticas?
¿Cómo calcularías los días entre ambas compras?
Enfoque — Una fila por usuario con una marca de tiempo por paso
Creo una fila por usuario mediante agregación condicional y tomo la primera marca de cada paso, evitando contar eventos repetidos. Si el orden es obligatorio, verificación debe ocurrir después del registro, onboarding después de verificar y compra después del onboarding. Calculo conversión entre pasos y total. Cada numerador cuenta usuarios únicos en el paso siguiente y cada denominador en el anterior. Segmentos por plataforma, canal, dispositivo, región y cohorte revelan dónde se concentra el abandono. Reviso duplicados, pasos omitidos, zonas horarias, cuentas de prueba y eventos tardíos.
Posibles preguntas de seguimiento
¿Cómo impondrías el orden de eventos?
¿Cómo investigarías una caída repentina en onboarding?
¿Cómo visualizarías el embudo?
Preguntas sobre métricas y casos de negocio
Estos casos evalúan si defines la métrica adecuada, segmentas cambios con sentido y recomiendas una acción con un nivel de confianza proporcionado.
Enfoque — Validar → Segmentar → Revisar embudo → Factores externos → Recomendar
Primero compruebo si la caída es real: cambios de instrumentación, retrasos de pipeline, zonas horarias, filtros de bots, versiones y comparación con datos sin procesar. Después segmento por plataforma, versión, región, canal, antigüedad, plan, dispositivo y fuente. Reviso el recorrido: ¿cayeron aperturas, inicios de sesión, vistas o acciones principales? Aperturas estables con menos actividad apuntan al producto; menos aperturas pueden indicar notificaciones, adquisición, estacionalidad, una caída del servicio o un factor externo. La medida responde a la causa, como revertir una versión con más fallos. Si los datos llegan tarde, comunico la limitación en vez de crear falsa urgencia.
Posibles preguntas de seguimiento
¿Qué visualización revisarías primero?
¿Cómo distinguirías estacionalidad de una regresión?
¿Qué implica menos DAU con más ingresos?
Enfoque — Objetivo → Métrica principal → Impulsores → Controles → Segmentos
Aclaro si el objetivo es descubrimiento, interacción, conversión, retención o cesta. La métrica principal debe reflejar valor, no solo clics; en comercio electrónico, por ejemplo, compras procedentes de recomendaciones por usuario activo. Los impulsores pueden incluir impresiones, CTR, añadir a cesta, conversión, ingresos por sesión, cobertura y diversidad. Los controles incluyen devoluciones, reembolsos, clics irrelevantes, latencia, quejas y canibalización. Segmento por usuarios nuevos o recurrentes, categoría, dispositivo y superficie. Un A/B mide el corto plazo; retención y recompra muestran si el valor perdura.
Posibles preguntas de seguimiento
¿Qué ocurre si aumenta el CTR pero no las compras?
¿Cómo medirías la calidad de las recomendaciones?
¿Cómo detectarías canibalización?
Enfoque — Descomponer ingresos en tráfico, conversión, cesta, mezcla, precio y retención
Más tráfico puede compensar una conversión inferior. También puede subir la cesta por precios, paquetes, grandes clientes o productos más caros. Otra posibilidad es tener menos visitantes, pero de mayor valor, o una definición de seguimiento distinta. Segmento por canal, producto, región, clientes nuevos y recurrentes, grupo y dispositivo. Después descompongo ingresos en sesiones, conversión, cesta, reembolsos y recompra, y verifico si la conversión se mide por sesión, usuario o visitante. La valoración depende de calidad y sostenibilidad, no solo del aumento de ingresos.
Posibles preguntas de seguimiento
¿Qué descomposición harías primero?
¿Qué ocurre si el aumento procede solo de una subida de precios?
¿Cómo comprobarías su sostenibilidad?
Cuadros de mando y visualización
Un buen cuadro de mando no es una colección de gráficos: es una herramienta de decisión para un público claramente definido.
Enfoque — Público → Decisiones → Métricas → Segmentos → Alertas
Primero aclaro el público y las decisiones. La dirección necesita una visión resumida de crecimiento, retención, monetización y riesgo, no todo el detalle operativo. Arriba mostraría MRR, retención neta y bruta, MRR nuevo, expandido, reducido y perdido, clientes activos, conversión de prueba a pago, ARPU, quizá recuperación de CAC y real frente a objetivo. Segmentar por tipo de cliente, canal, plan, región, tamaño y ventas frente a autoservicio permite diagnosticar. Tendencias, cohortes, un puente de MRR, causas de baja y desviación del objetivo responden si crecemos, por qué, dónde hay riesgo y qué investigar. Deben verse definiciones, actualización, filtros, responsables y umbrales.
Posibles preguntas de seguimiento
¿Qué pondrías en el primer pantallazo?
¿Cómo cambiaría para un Product Manager?
¿Cómo evitarías interpretaciones erróneas?
Enfoque — Aclarar decisión → Explicar riesgo → Proponer una vista mejor
Primero aclaro qué decisión debe facilitar. Después explico el riesgo de forma objetiva: los ingresos acumulados pueden ocultar desaceleración, un gráfico circular con demasiadas categorías puede ocultar diferencias o no mostrar intervalos puede generar falsa precisión. Propongo una visualización mejor de la misma pregunta: serie temporal, cohortes, embudo, distribución, barras segmentadas o descomposición. Si aún necesitan la vista original, puede incluirse con limitaciones claras; no la presentaría como mi recomendación. Ser útil y mantener la integridad analítica son compatibles.
Posibles preguntas de seguimiento
¿Cómo gestionas la presión de un directivo?
¿Qué gráficos suelen utilizarse mal?
¿Cómo representarías la incertidumbre?
Preguntas sobre Excel y hojas de cálculo
Muchos puestos utilizan hojas intensivamente. Se evalúan fórmulas, tablas dinámicas, limpieza, conciliación y modelos auditables.
Enfoque — Perfilar → Estandarizar → Validar → Documentar
Primero perfilo filas, columnas, nulos, duplicados, tipos, valores imposibles, fechas y atípicos, y conservo una copia sin modificar. Después elimino espacios, normalizo nombres, interpreto fechas, convierto unidades y asigno categorías incoherentes a una lista controlada. Antes de deduplicar, defino la clave empresarial. Luego concilio totales y recuentos con una fuente fiable y compruebo nulos, valores únicos y rangos. Documento las transformaciones, separo datos originales y limpios y evito cambios manuales ocultos.
Posibles preguntas de seguimiento
¿Cómo tratarías filas duplicadas?
¿Qué fórmulas utilizas con mayor frecuencia?
¿Cómo harías auditable el archivo?
Enfoque — Exploración frente a cálculo controlado
Las tablas dinámicas sirven para explorar, agrupar y resumir rápidamente por dimensiones. Las fórmulas son mejores para lógica personalizada, multietapa o auditable, como cohortes, puentes, puntuaciones ponderadas, excepciones o conciliaciones. En la práctica utilizo tablas dinámicas para detectar patrones y después construyo un modelo controlado. Los informes recurrentes deberían migrar a una canalización reproducible de SQL o BI en lugar de depender de una hoja manual frágil.
Posibles preguntas de seguimiento
¿Qué riesgos tienen las tablas dinámicas?
¿Cómo compararías VLOOKUP con INDEX/MATCH o XLOOKUP?
¿Cuándo moverías un análisis de Excel a SQL o BI?
Experimentos y pruebas A/B
Se evalúa si sabes diseñar, analizar y cuestionar experimentos y qué conclusiones permiten realmente los datos.
Enfoque — Hipótesis → Aleatorización → Métricas → Controles → Decisión
La hipótesis es que el nuevo diseño reduce fricción y aumenta compras completadas sin causar daños posteriores. Compruebo unidad de aleatorización, muestra, duración, exposición, elegibilidad y asignación persistente; aleatorizar por sesión puede mezclar variantes para usuarios recurrentes. La métrica principal es conversión desde inicio del checkout hasta compra. Secundarias: errores de pago, duración, cesta y ventas adicionales. Controles: reembolsos, chargebacks, soporte, latencia, errores y quejas. Además de significación estadística, importa la relevancia práctica. Solo recomendaría desplegar con una mejora útil, controles sanos, seguimiento fiable y efecto estable.
Posibles preguntas de seguimiento
¿Qué ocurre si suben conversión y reembolsos?
¿Cómo evitas mirar resultados demasiado pronto?
¿Qué harías si solo se benefician usuarios nuevos?
Enfoque — Revisar potencia → Evaluar dirección → Ponderar coste → Decidir
No significativo no significa necesariamente sin efecto. Compruebo si muestra y duración podían detectar una diferencia relevante. Después reviso tamaño del efecto e intervalo: uno amplio que incluye beneficio y daño es inconcluso; uno estrecho alrededor de cero sugiere poco impacto. También considero mantenimiento, riesgo y estrategia. Una función cara sin beneficio medible no debería desplegarse. Si tiene valor estratégico o coste bajo, puede iterarse o medirse mejor. El resumen separa con claridad diseño, observación, confianza, límites y recomendación.
Posibles preguntas de seguimiento
¿En qué se diferencian «sin efecto» e «inconcluso»?
¿Cómo lo explicarías a personas no técnicas?
¿Cuándo repetirías la prueba?
Calidad de datos y criterio analítico
Un análisis solo es tan fiable como sus datos. Se evalúa si detectas errores antes de que impulsen una decisión equivocada.
Enfoque — Definiciones → Fuentes → Filtros → Granularidad → Momento → Conciliación
Primero comparo definiciones: bruto o neto de reembolsos, descuentos, impuestos y chargebacks; fecha de pedido, pago, envío o factura. Después reviso fuentes, filtros y granularidad. Las diferencias pueden proceder de pruebas, cancelaciones, cuentas internas, regiones, joins de líneas, zonas horarias o actualización. Partiendo de una fuente fiable, creo un puente: sumo o resto cada diferencia identificada hasta conciliar ambas cifras. El resultado no es solo declarar un cuadro incorrecto, sino fijar una definición, un responsable, una fuente oficial y una medida para evitar que se repita.
Posibles preguntas de seguimiento
¿Cómo eliges la fuente oficial?
¿Qué ocurre si Finanzas y Producto necesitan definiciones distintas?
¿Cómo comunicarías la discrepancia?
Enfoque — Medir ausencias → Identificar causa → Elegir tratamiento → Declarar
Primero cuantifico ausencias por campo, proporción, segmento, tiempo, fuente y plataforma, porque rara vez son aleatorias. Después identifico la causa: campo opcional, error de seguimiento, retraso, integración, privacidad o valor no aplicable. Según la causa, excluyo filas, imputo con justificación, creo una categoría desconocida, completo desde otra fuente o limito el análisis. Cero y desconocido no son equivalentes. Explico cómo afectan los datos ausentes a la confianza y si la conclusión se mantiene bajo supuestos razonables.
Posibles preguntas de seguimiento
¿Cuándo puedes excluir filas?
¿Qué riesgo tiene la imputación?
¿Cómo detectarías un fallo de seguimiento?
Preguntas de comportamiento e interesados
Estas preguntas abordan ambigüedad, presión, comunicación, priorización y situaciones donde los datos no respaldaron la respuesta deseada.
Enfoque — Decisión → Análisis → Hallazgo → Recomendación → Impacto
Elijo una historia donde mi análisis influyera en un lanzamiento, precio, marketing, producto, operación o prioridad. Explico de forma accesible qué datos y métricas utilicé, qué segmentos importaban y qué hallazgo inesperado apareció, sin perderme en herramientas. Después expongo recomendación e impacto: por ejemplo, reasignar presupuesto tras detectar un canal deficitario o revertir una función que elevaba clics pero dañaba retención. Incluyo límites, incertidumbre y cómo alineé a los interesados.
Posibles preguntas de seguimiento
¿Cómo mediste el impacto?
¿Quién discrepo de la recomendación?
¿Qué harías hoy de otra manera?
Enfoque — Aclarar urgencia → Dar orientación → Explicar límites → Planificar validación
Aclaro primero la decisión, el plazo y el riesgo. Para una decisión reversible y de poco riesgo puede bastar una orientación preliminar; para ingresos, clientes, cumplimiento o estrategia, el estándar de calidad debe ser mayor. Separo lo que puede responderse hoy de lo que no y, como máximo, doy una estimación preliminar etiquetada con su confianza. A la vez detallo limpieza, validación, conciliación y fecha de una respuesta fiable. Así el interesado puede actuar sin convertir una cifra rápida y errónea en una falsa verdad.
Posibles preguntas de seguimiento
¿Cómo rechazarías un plazo irreal?
¿Cuándo basta una respuesta orientativa?
¿Cómo comunicarías el nivel de confianza?
Enfoque — Impacto → Urgencia → Esfuerzo → Dependencia → Alineación
Priorizo por impacto, urgencia, esfuerzo, dependencias y reversibilidad de la decisión. Un análisis para un lanzamiento mañana suele superar una mejora opcional de un cuadro. Para cada solicitud aclaro decisión y responsable. Los informes manuales recurrentes son candidatos a automatización. Cuando existe conflicto, explico qué puede entregarse y cuándo, qué decisión depende de ello y por qué recomiendo ese orden. El tiempo analítico debe utilizarse donde mejora decisiones, no solo para cerrar solicitudes.
Posibles preguntas de seguimiento
¿Cómo dices que no?
¿Qué trabajo automatizarías?
¿Cómo tratas una petición de dirección?
Practica tus respuestas en directo
Interview Pilot te sugiere respuestas en tiempo real durante entrevistas reales para ayudarte a responder con claridad.