PROCESIA

Data Scientist NLP – IA

PROCESIA Madrid, Community of Madrid, Spain

IT Services and IT Consulting · 201-500 employees

17 h ago
data-scientist Senior (5-10 yrs) Full-time Spain
Create a free account to apply — email only, no card. You can also save this posting or score it against your profile with AI.

About the role

Design and train NLP models, including classic and Transformer-based architectures, to solve business problems like classification and semantic search. Collaborate with development teams to integrate AI solutions into APIs and services while maintaining clear documentation.

What they look for

Python NLP Generative AI LLMs RAG Pandas Numpy Scikit-learn Fine-tuning Embeddings Kubernetes CI/CD Data visualization Matplotlib Seaborn Vector databases

Requirements

Requires at least 7 years of IT experience with 5 years specifically in large-scale data or AI projects. Candidates must have deep practical experience with NLP, Python, and Generative AI architectures like RAG and LLMs.

Benefits

Private health insurance English classes Certification support Flexible hours Intensive summer schedule Free coffee and tea Professional career plan

Full description

¿Y si tu trabajo fuera decidir cómo hablan y entienden el lenguaje las soluciones de IA que usan miles de personas? 

Ese es el corazón de este rol:

Buscamos a alguien que disfrute tanto afinando un modelo como discutiendo el mejor prompt, la métrica adecuada o el tipo de explicación que necesita un usuario no técnico.

¿Quiénes somos?

En PROCESIA construimos soluciones donde la IA deja de ser un buzzword y se convierte en asistentes, buscadores inteligentes, sistemas de ayuda y herramientas que entienden el lenguaje humano.​ Trabajamos en proyectos de alto impacto, con equipos donde conviven perfiles muy técnicos y otros muy funcionales, y donde cada persona puede aportar su mirada a cómo debe comportarse la IA.

El reto: darle forma a la IA que entiende el lenguaje

No buscamos un perfil de datos más, buscamos a quien se pregunte constantemente: ¿de verdad este modelo está entendiendo lo que el usuario quiere decir?.​

Tu terreno será el texto: desde documentos largos a consultas breves, desde prompts para LLMs hasta métricas que midan si la IA está respondiendo bien.

Disfrutarás si:

  • Te mueves con naturalidad entre Python, pandas, numpy, scikit‑learn, y no tienes miedo a abrir un notebook y explorar datos textuales desde cero.​
  • Has pasado varios años construyendo soluciones de NLP (clasificación, extracción de entidades, búsqueda semántica, resúmenes, etc.), no solo leyendo papers.​
  • Te interesa especialmente la IA generativa: arquitecturas RAG, LLMs como GPT, LLaMa o Mistral, embeddings, fine‑tuning y evaluación de modelos grandes.​
  • Disfrutas explicando resultados a gente no técnica, buscando ejemplos claros y visualizaciones que cuenten la historia del modelo.​

¿Qué harás en el día a día?

Formarás parte de un equipo donde también hay Consultores Python, arquitectos y otros Data Scientists, con los que co‑diseñarás soluciones end‑to‑end.​

En la práctica, te ocuparás de:

  • Diseñar y entrenar modelos de NLP, tanto clásicos como basados en Transformers, para resolver problemas concretos (búsqueda, clasificación, extracción, resumen, etc.).​
  • Preparar y entender los datos textuales: limpieza, normalización, anotación, definición de etiquetas y métricas que tengan sentido para negocio.​
  • Construir y mejorar soluciones de IA generativa sobre RAG, trabajando con embeddings, recuperación de contexto y prompts para modelos como GPT, LLaMa o Mistral.​
  • Trabajar mano a mano con el equipo de desarrollo para que tus modelos se integren en APIs y servicios que funcionan en Kubernetes y entornos CI/CD.​
  • Documentar de forma clara lo que hace el modelo, sus límites y cómo evolucionarlo, ayudando a que el conocimiento no se quede solo en el código.​

Lo que necesitamos de tu experiencia

Este, no es un rol junior; vas a tomar decisiones que definen cómo se comportan soluciones de IA clave.​

Por eso buscamos:

  • Al menos 7 años de experiencia en proyectos TI y 5 años trabajando en soluciones de datos o inteligencia artificial a gran escala.​
  • Varios años de práctica real en NLP y ciencia de datos con Python (pandas, numpy, scikit‑learn, visualización con matplotlib, seaborn y notebooks).​
  • Experiencia demostrable trabajando con IA generativa, LLMs y arquitecturas RAG, más allá de pruebas puntuales.​
  • Valorable experiencia con Kubernetes, orquestación de contenedores, observabilidad y bases de datos vectoriales, trabajando en equipo con perfiles de MLOps y backend.​

¿Qué te ofrecemos?

Además del reto técnico, queremos que sientas que estás en un lugar donde puedes crecer y tener voz propia en cómo se construyen la

  • Proyecto estable, de gran visibilidad y con una fuerte carga tecnológica e innovadora en servicios de inteligencia artificial.
  • Modalidad hibrida con 33% de presencialidad (Pozuelo de Alarcón / Zona norte)
  • Contrato indefinido, jornada completa, modelo híbrido/remoto y horarios flexibles para que conciliar sea algo real, no un deseo.
  • Clases de inglés desde el primer día, soporte para certificaciones técnicas y un plan de carrera personalizado pensado para que tu perfil arquitecto siga creciendo cada año.
  • 3 meses de jornada intensiva en verano y jornada intensiva todos los viernes, además de no trabajar Nochebuena ni Fin de Año.
  • Seguro médico privado sin copagos, entorno cercano y positivo, café y té gratis en oficina y un modelo de Management 3.0 donde tu criterio pesa y se escucha.
  • Salario competitivo, alineado con tu experiencia y potencial.

Si te apetece que tu próximo paso en IA no sea más de lo mismo, esta puede ser tu oportunidad

Similar roles