Data Engineer (Python & PySpark)
TECDATA ENGINEERING Spain · €36K/yr
IT Services and IT Consulting · 201-500 employees
About the role
The role involves designing and developing robust, scalable data pipelines and ETL/ELT processes to handle large volumes of information. You will also be responsible for optimizing batch processes, managing data models, and collaborating with technical teams in an Agile environment.
What they look for
Requirements
Candidates must have solid experience with Python, PySpark, and batch processing, along with advanced SQL skills. Proficiency in relational databases and experience in building scalable data pipelines are essential requirements for this position.
Full description
Buscamos un/a Data Engineer con experiencia sólida en procesamiento de datos y construcción de pipelines escalables para incorporarse a un proyecto tecnológico orientado a entornos Big Data y procesamiento Batch.
La persona seleccionada participará en el diseño, desarrollo y optimización de procesos ETL/ELT sobre grandes volúmenes de información, trabajando en arquitecturas modernas basadas en Python y PySpark.
📍 Modalidad: 100% Remoto 💰 Salario: 36K 📄 Proyecto estable 🕒 Jornada completa
Responsabilidades
- Diseño y desarrollo de pipelines de datos robustos y escalables
- Procesamiento y transformación de grandes volúmenes de información mediante PySpark
- Desarrollo de procesos ETL/ELT eficientes
- Optimización de rendimiento sobre procesos Batch
- Manipulación y explotación de datos mediante SQL avanzado
- Diseño y mantenimiento de modelos de datos relacionales
- Desarrollo de scripts de automatización en Python
- Integración de fuentes de datos y procesos de carga masiva
- Optimización de consultas complejas y rendimiento de bases de datos
- Participación en procesos de calidad y validación de datos
- Colaboración con equipos técnicos y analíticos en entornos Agile
Requisitos técnicos
Imprescindibles
✔ Experiencia sólida con Python ✔ Experiencia avanzada con PySpark ✔ Experiencia en procesamiento Batch ✔ Dominio de SQL y optimización de consultas ✔ Experiencia desarrollando pipelines ETL/ELT ✔ Manejo de grandes volúmenes de datos ✔ Experiencia con bases de datos relacionales
Bases de datos
✔ PostgreSQL ✔ MySQL ✔ SQL Server
Muy valorable
✔ Experiencia en arquitecturas Big Data ✔ Optimización de DataFrames y Spark SQL ✔ Automatización de procesos de datos ✔ Experiencia en entornos cloud ✔ Conocimientos de buenas prácticas en ingeniería de datos ✔ Experiencia trabajando en entornos Agile/Scrum
Stack tecnológico
- Python
- PySpark
- Spark SQL
- DataFrames API
- SQL
- PostgreSQL
- MySQL
- SQL Server
- ETL / ELT
- Batch Processing
Perfil buscado
- Perfil analítico y orientado a calidad de datos
- Capacidad de trabajar de forma autónoma
- Mentalidad resolutiva y orientación a rendimiento
- Experiencia en entornos de procesamiento masivo
- Buenas prácticas de desarrollo y optimización
- Capacidad de adaptación y trabajo en equipo
Proyecto ideal para perfiles especializados en ingeniería de datos, procesamiento distribuido y optimización de pipelines Big Data en entornos modernos y escalables.
Similar roles
-
Développeur GO / Python H/F
NEXTON Mougins, Provence-Alpes-Côte d'Azur, France
-
Python Backend Developer - AI
Zensar Pune, Maharashtra, India
-
Développeur Backend (Python) Senior - Paris - H/F
Iliad - Free Paris, Ile-de-France, France · €45K–€60K/yr
-
Coder with Python knowledge - Remote in France
DataForce by TransPerfect Paris, Ile-de-France, France
-
Staff Python
Alaffia Health New York, New York, United States
-
Python Developer (Quant/Data Science)
Glint Tech Solutions LLC Nashville, Tennessee, United States