Data engineer Middle

Axity

hybridPosted Jul 3, 2026
Posting intelligenceActively listedReposted 16×, possible evergreen/ghost posting

Skills

sqlalchemybigquerytableauairflowlookerpandasgithubpythonjiragoogleclouddeeplearning

About the role

INFORMACION

CONSULTOR

hace 42 minutos

Descripción

Buscamos un Data Engineer Mid enfocado en la migración controlada de activos de datos desde entornos BigQuery Sandbox hacia una plataforma gobernada en GCP Data Lake. El objetivo del rol es garantizar la continuidad del negocio durante la migración, asegurando integridad, trazabilidad y disponibilidad de la información en el nuevo entorno.

La persona seleccionada participará en la migración de pipelines ETL/ELT, desarrollo e ingesta de datos desde múltiples fuentes, validación y reconciliación de información, documentación de linaje y metadata, así como en la optimización de procesos analíticos existentes. También colaborará con equipos técnicos y de negocio para identificar dependencias, reconectar reportes y apoyar el decommission de sandboxes locales.

Esta posición requiere un perfil con experiencia sólida en ingeniería de datos, dominio de BigQuery y SQL avanzado, conocimientos en Python y orquestación con Airflow y/o Concord, además de habilidades para trabajar en entornos colaborativos y con atención al detalle.

Requisitos

3-5 años de experiencia en ingeniería de datos

Dominio de BigQuery: CREATE TABLE/VIEW, External Tables, Scheduled Queries, optimización de queries

Experiencia con Airflow y/o Concord para orquestación de pipelines

Capacidad de mapear dependencias de datos y coordinar con owners de negocio

Atención al detalle en validación de integridad de datos post-migración

Python para scripting y automatización de tareas de migración

Inglés básico-intermedio (lectura de documentación técnica)

Experiencia en retail o proyectos de consolidación de datos (deseable)

Habilidades técnicas indispensables

SQL avanzado / BigQuery

Python (pandas, PySpark, SQLAlchemy)

Desarrollo de pipelines ETL/ELT (Concord, Airflow o equivalentes)

Google Cloud Platform (GCP): BigQuery, Cloud Storage, Dataflow

Herramientas de gobierno y calidad de datos

Control de versiones (Git / GitHub)

Habilidades técnicas deseables

Experiencia en proyectos de migración de datos

Experiencia en retail o proyectos de consolidación de datos

Actividades a realizar

Migración de pipelines ETL/ELT desde entornos Sandbox (BigQuery) hacia la plataforma de datos gobernada

Desarrollo e ingesta de datos desde múltiples fuentes hacia el Data Lake centralizado

Implementación de controles de calidad de datos (validaciones, reconciliación y monitoreo)

Documentación de linaje y metadata conforme a los estándares de gobierno de datos

Refactorización y optimización de procesos analíticos existentes para cumplir con políticas globales

Colaboración con dominios de negocio (Finanzas, Ventas, Operaciones) para garantizar la entrega de datos confiables

Soporte a decommission de sandboxes locales coordinando con los equipos técnicos y de negocio

Recrear y validar estructuras de tablas en CMZ (wmt-mx-dl-controlledmgzn-prod)

Migrar datos históricos por tabla con validación de integridad (volúmenes, frecuencias, reglas de negocio)

Reconfigurar scheduled queries que generan tablas derivadas desde EDW PROD / Data Lake

Identificar y documentar dependencias upstream/downstream por dominio

Desarrollar pipelines de ingesta en Airflow hacia capas Raw - Catalog - Cmp

Configurar y validar procesos de carga en el nuevo entorno gobernado

Reconectar integraciones de sistemas y reportes (Looker, Power BI, Tableau) a nuevas tablas

Completar metadata de tablas migradas (owner, descripcion, linaje)

Ejecutar pruebas de validación y reconciliación de datos contra fuente original

Levantar tickets JIRA para solicitudes de nuevos datasets con justificación de negocio

Perfil

CONSULTOR

Localización

Huixquilucan, Estado de México, México (Híbrido)

Experiencia

3 Años de Experiencia

o

Questions about this role

Click "Apply with AI Applyd" above. We auto-fill the application from your resume and answer screening questions in seconds. No copy and paste, no juggling tabs.

Compensation varies by seniority, employer size, and location. When this listing publishes a salary band you'll see it in the badge row above the description.

Most applications complete in under 90 seconds. You can track the status in your dashboard and watch the screenshot proof land the moment the application submits.

AI Applyd supports Greenhouse, Lever, Ashby, Workday, iCIMS, SmartRecruiters, Personio, Teamtailor and other major ATS platforms. If we can submit through the platform, we do.

Want AI Applyd to auto-apply to roles like this?

We tailor your resume per posting, fill the forms, and track replies for you.