Inetum

Ingeniero de datos - Python Expert

Inetum · Bogota, Capital District, RAP (Especial) Central, Colombia

IT Services and IT Consulting · 10,001+ employees

4 h ago
Mid (2-5 yrs) Full-time Colombia
Log in to apply, save this posting, or score it against your profile with AI.

About the role

Design, develop, and maintain scalable data pipelines and ETL/ELT processes using Python and PySpark. Collaborate with analytics and business teams to implement cloud-based data architectures and ensure data quality and availability.

What they look for

Python Pandas NumPy PySpark ETL/ELT SQL Apache Spark Apache Airflow AWS REST APIs Git Docker Data Lakehouse Data Warehouse Linux Unit Testing

Requirements

Requires solid experience in Python data solutions, advanced SQL, and distributed processing with Apache Spark. Proficiency in cloud services (preferably AWS) and orchestration tools like Airflow or DBT is expected.

Full description

Descripción de la empresa

Inetum es una compañía global de servicios de tecnología e innovación digital, presente en más de 26 países. En Colombia, Inetum ofrece soluciones tecnológicas avanzadas que impulsan la transformación digital de empresas en diversos sectores, brindando servicios en consultoría, desarrollo de software, integración de sistemas, outsourcing y soporte técnico.

Con un enfoque en la agilidad y adaptabilidad, Inetum Colombia busca crear valor para sus clientes mediante la implementación de tecnologías innovadoras que mejoren la eficiencia y productividad. Nuestro equipo está compuesto por expertos en diversas áreas tecnológicas que trabajan en un entorno colaborativo, dinámico y orientado a resultados. Únete a Inetum y sé parte de una compañía que está transformando el futuro de las empresas a través de la tecnología.

Descripción del empleo

Responsabilidades 

  • Diseñar, desarrollar y mantener pipelines de datos escalables y eficientes utilizando Python.
  • Construir, automatizar y optimizar procesos ETL/ELT usan Python para la ingesta, transformación y carga de datos desde múltiples fuentes.
  • Desarrollar soluciones de procesamiento de datos mediante librerías como Pandas, NumPy y PySpark.
  • Garantizar la calidad, consistencia, trazabilidad, monitoreo y disponibilidad de los datos.
  • Implementar validaciones y controles de calidad sobre los flujos de información.
  • Procesar grandes volúmenes de datos estructurados y no estructurados mediante Python.
  • Diseñar e integrar soluciones mediante APIs REST, servicios web y conectores de datos, con Python.
  • Colaborar con equipos de analítica, ciencia de datos, desarrollo y negocio para traducir requerimientos en soluciones técnicas.
  • Participar en la definición e implementación de arquitecturas de datos sobre entornos cloud.
  • Apoyarse en herramientas de IA Generativa, Copilot y agentes inteligentes para acelerar el desarrollo, documentación y resolución de incidentes.
  • Documentar desarrollos, procesos, flujos de datos y buenas prácticas de ingeniería.
  • Interactuar directamente con clientes, entendiendo necesidades de negocio y proponiendo soluciones tecnológicas de valor.
  • Realizar optimización y monitoreo continuo del rendimiento de procesos y pipelines de datos.

Requisitos

Requisitos Técnicos

  • Experiencia sólida desarrollando soluciones de datos con Python.
  • Dominio de librerías para procesamiento y análisis de datos como Pandas, NumPy y PySpark.
  • Experiencia en desarrollo de procesos ETL/ELT y automatización de flujos de datos.
  • Conocimiento avanzado de SQL para consultas, transformaciones y optimización de rendimiento.
  • Experiencia con bases de datos relacionales y no relacionales (PostgreSQL, MySQL, SQL Server, MongoDB, DynamoDB u otras).
  • Experiencia práctica con Apache Spark y PySpark para procesamiento distribuido de datos.
  • Conocimientos en transformación, limpieza, validación y enriquecimiento de datos.
  • Familiaridad con herramientas de orquestación y transformación como Apache Airflow, DBT, AWS Glue o similares.
  • Entendimiento de arquitecturas Data Lake, Lakehouse y Data Warehouse.
  • Experiencia trabajando con servicios cloud, preferiblemente AWS (S3, Glue, Lambda, Athena, EMR, Redshift) o equivalentes en Azure/GCP.
  • Conocimiento en integración de sistemas mediante APIs REST y manejo de formatos JSON, CSV, Parquet y Avro.
  • Manejo de Git/GitHub/GitLab y aplicación de buenas prácticas de desarrollo y versionamiento.
  • Conocimiento de pruebas unitarias y aseguramiento de calidad para desarrollos Python.
  • Experiencia en ambientes Linux y gestión de entornos virtuales de Python.
  • Conocimiento deseable en Docker y despliegue de aplicaciones orientadas a datos.
  • Experiencia utilizando herramientas de automatización, observabilidad y monitoreo de procesos de datos.
  • Conocimientos en Control M y Data X (deseable).

Información adicional

Competencias Profesionales

  • Alta capacidad analítica y orientación a la calidad de los datos.
  • Pensamiento lógico y habilidades avanzadas de resolución de problemas.
  • Comunicación clara y efectiva con equipos técnicos y usuarios de negocio.
  • Experiencia en levantamiento de requerimientos y relacionamiento con clientes.
  • Capacidad para trabajar en equipos multidisciplinarios.
  • Proactividad y orientación a la mejora continua.
  • Autonomía, organización y responsabilidad en la entrega de resultados.
  • Adaptabilidad a nuevas tecnologías y entornos dinámicos.
  • Mentalidad de automatización y optimización de procesos.