Big Data Engineer
- Softtek
- Mexico City, Mexico
- MXN 600,000 – MXN 900,000
Habilidades Requeridas:
- Experiencia sólida en Python, PySpark, PySpark SQL y SQL.
- Conocimiento y experiencia en procesos ETL y procesamiento de grandes volúmenes de datos.
- Experiencia trabajando con entornos Cloudera.
- Manejo de herramientas de control de versiones como GitHub.
- Capacidad para desarrollar, mantener y optimizar pipelines de procesamiento de datos.
- Experiencia generando y manteniendo documentación técnica de desarrollos, procesos y soluciones implementadas.
- Conocimiento de buenas prácticas de desarrollo, calidad de código y estándares de programación.
- Capacidad para identificar problemas, analizar causas raíz y proponer soluciones eficientes.
- Experiencia colaborando con equipos multidisciplinarios en entornos ágiles.
- Habilidad para desarrollar soluciones robustas, escalables y mantenibles.
Habilidades Deseables:
- Experiencia con herramientas como Artifactory, RLM y Jenkins.
- Inglés intermedio para lectura y comprensión de documentación técnica.
- Experiencia en optimización de código orientada a desempeño y eficiencia.
- Conocimientos en monitoreo, análisis y mejora de procesos ETL.
- Familiaridad con prácticas de integración continua y despliegue continuo (CI/CD).
- Experiencia en ecosistemas Big Data y arquitecturas distribuidas.
- Conocimiento de marcos y librerías relacionadas con Machine Learning.
- Experiencia en proyectos de modernización y mejora de plataformas de datos.
Responsabilidades
- Diseñar, desarrollar y mantener procesos de integración y transformación de datos utilizando Python, PySpark y SQL.
- Construir y optimizar pipelines de datos para garantizar eficiencia, escalabilidad y calidad de la información.
- Participar en el desarrollo y mejora continua de soluciones de Machine Learning y procesamiento de datos.
- Implementar buenas prácticas de desarrollo, asegurando la calidad y mantenibilidad del código.
- Analizar y optimizar el desempeño de procesos ETL y aplicaciones de procesamiento de datos.
- Colaborar con equipos de negocio, datos y tecnología para traducir requerimientos en soluciones técnicas.
- Gestionar versiones de código fuente y participar en procesos de integración y despliegue utilizando herramientas de DevOps.
- Elaborar y mantener documentación técnica de procesos, componentes y desarrollos.
- Identificar oportunidades de automatización, innovación y mejora continua.
- Participar activamente en revisiones técnicas y propuestas de optimización de arquitectura y procesos.
Idiomas Requeridos
Inglés Intermedio Bajo
Ubicación
México - Hibrido
Skills
- Python
- PySpark
- SQL
- ETL
- Cloudera
- Git
- CI/CD
