TECDATA ENGINEERING

Data Scientist

TECDATA ENGINEERING Madrid, Community of Madrid, Spain

IT Services and IT Consulting · 201-500 employees

4 d ago
Remote data-scientist Mid (2-5 yrs) Full-time Spain
Create a free account to apply — email only, no card. You can also save this posting or score it against your profile with AI.

About the role

The Data Scientist will design and train machine learning models for forecasting and user propensity, while managing large-scale data ingestion and cleaning. They are also responsible for deploying models to production using GCP tools and providing third-level support for production incidents.

What they look for

Machine Learning Forecasting Propensity Modeling Optimization Algorithms Data Cleaning Data Ingestion Google Cloud Platform Airflow BigQuery Vertex AI Python SQL Apache Spark Distributed Processing Production Deployment

Requirements

Candidates must have advanced proficiency in Python and SQL, with demonstrable experience in machine learning and distributed processing using Apache Spark. Strong technical expertise in Google Cloud Platform, specifically Airflow, BigQuery, and Vertex AI, is required.

Full description

Buscamos un Perfil Data Scientist

Responsabilidades y Requisitos:

  • Modelado Avanzado (ML):
  • Experiencia demostrable en el diseño y entrenamiento de modelos de forecasting utilizando técnicas de Machine Learning.
  • Desarrollo de modelos de propensión para entender el comportamiento de los usuarios.
  • Implementación de algoritmos optimizadores (programación lineal).
  • Preparación de datos: Capacidad sólida para la ingesta, limpieza y tratamiento integral de datos con volumetrías muy altas (miles de millones en muchos casos).
  • Dominio del Entorno GCP: Experiencia técnica trabajando en Google Cloud Platform, orquestando flujos de trabajo y desplegando modelos mediante el uso intensivo de Airflow, BigQuery y Vertex AI.
  • Stack Tecnológico Core: Dominio avanzado de Python para el desarrollo de modelos de Machine Learning y automatización, y SQL experto para la extracción y manipulación de datos. Experiencia trabajando con Apache Spark para el procesamiento distribuido (como complemento al uso principal del ecosistema GCP).
  • Desarrollo orientado a producción: Experiencia con desarrollo de algoritmos productivos, reduciendo al maximo el gap entre el código de desarrollo y producción.
  • Atender incidencias: Atender directamente las incidencias de 3N de los proyectos subidos a producción que se le hayan designado.

Similar roles