Babel Group

SRE (Site Reliability Engineer)

Babel Group · San Salvador Centro, San Salvador, El Salvador

IT Services and IT Consulting · 1,001-5,000 employees

Yesterday
Remote Senior (5-10 yrs) Full-time Guatemala
Log in to apply, save this posting, or score it against your profile with AI.

About the role

Lead the Site Reliability Engineering strategy for Central American applications, ensuring high availability, reliability, and operational efficiency. Manage incident response, implement observability solutions, and drive FinOps initiatives to optimize cloud costs.

What they look for

Kubernetes Site Reliability Engineering DevOps FinOps Observability Python Bash Ansible Azure Google Cloud Platform CI/CD Incident management Root cause analysis Grafana Prometheus Git

Requirements

Requires a bachelor's degree in Systems Engineering or a related field and at least 5 years of experience in infrastructure, operations, or DevOps. Candidates must have fluent English skills and proven expertise in Kubernetes, cloud platforms, and SRE practices.

Benefits

Professional development program Talent development Health and emotional wellness support Solidarity bonus Flexible work-life balance Referral bonus Commercial agreements

Full description

We are One Team. We make it happen. We are Unstoppable.

Babel, enriching people through technology

BABEL es una consultora tecnológica multinacional especializada en aplicar sus servicios y conocimiento tecnológico en los procesos de aceleración digital de sus clientes, grandes empresas y organismos públicos.

¿Cuál es nuestro plan estratégico?

¡Miramos hacia el futuro! Nuestro plan estratégico Hiperespacio 2029 promete ser un viaje emocionante, lleno de oportunidades para crecer y desarrollarse profesionalmente. Alcanzar 1000 millones de facturación, un reto que estamos seguros de que con la colaboración y el talento de nuestra gente, será otra historia de éxito que escribiremos juntos y juntas.

¿Qué buscamos?

Objetivo del Rol

Liderar la estrategia de Site Reliability Engineering (SRE) para las aplicaciones de Centroamérica, garantizando altos niveles de disponibilidad, confiabilidad, rendimiento y eficiencia operativa, con especial enfoque en las aplicaciones NextGen desplegadas en WCNP.

Este rol impulsará la adopción de prácticas DevOps, SRE y FinOps, promoviendo la automatización, la observabilidad, la gestión proactiva de incidentes y la optimización de costos en la nube, asegurando plataformas estables, escalables y alineadas con los objetivos del negocio.

Oportunidad disponible para personas de El Salvador y Guatemala.

Responsabilidades

  • Definir, implementar y monitorear SLOs, SLIs y Error Budgets para servicios críticos.
  • Diseñar y mantener la estrategia de observabilidad mediante métricas, logs, dashboards y alertas.
  • Monitorear la disponibilidad, rendimiento y estabilidad de las aplicaciones desplegadas en WCNP.
  • Liderar iniciativas de FinOps para optimizar el consumo y costos de la nube.
  • Apoyar la migración, incorporación y estabilización de aplicaciones en entornos Kubernetes.
  • Garantizar la confiabilidad de los despliegues mediante pipelines de CI/CD y procesos automatizados.
  • Automatizar tareas operativas utilizando Python, Bash, Ansible u otras herramientas para reducir el trabajo manual (toil).
  • Liderar la atención de incidentes críticos, realizar análisis de causa raíz (RCA) y asegurar la implementación de acciones correctivas y preventivas.
  • Definir y dar seguimiento a indicadores como MTTR, disponibilidad, métricas DORA y recurrencia de incidentes.
  • Promover buenas prácticas de SRE, DevOps y Observabilidad, brindando acompañamiento técnico al equipo.

Tech Stack

Indispensable

  • Kubernetes y tecnologías de contenedores.
  • WCNP o plataformas basadas en Kubernetes.
  • Grafana, Prometheus y herramientas de observabilidad.
  • Herramientas de gestión y análisis de logs.
  • Python y/o Bash.
  • Concord, Looper o herramientas equivalentes de CI/CD.
  • Azure y/o Google Cloud Platform (GCP).
  • Git.
  • SLOs, SLIs, Error Budgets, gestión de incidentes y RCA.
  • Herramientas de IA aplicadas a operaciones, análisis de logs y automatización.

Deseable

  • Terraform.
  • Ansible.
  • OpenTelemetry.
  • Herramientas de FinOps.
  • Plataformas de trazabilidad distribuida.
  • Métricas DORA.
  • Chaos Engineering y pruebas de resiliencia.

Requisitos

  • Bachillerato universitario en Ingeniería en Sistemas, Computación o carreras afines.
  • Inglés fluido (B2+/C1), con capacidad para participar en reuniones técnicas, colaborar con equipos globales y comprender documentación especializada.
  • 5 años o más de experiencia en infraestructura, operaciones, DevOps, Cloud o confiabilidad de aplicaciones.
  • 3 años o más de experiencia en roles de Site Reliability Engineering (SRE), DevOps, Platform Engineering o Cloud Engineering.
  • Experiencia comprobada con Kubernetes y tecnologías de contenedores.
  • Experiencia implementando soluciones de observabilidad, monitoreo y alertamiento.
  • Experiencia con automatización y gestión de pipelines CI/CD.
  • Experiencia en gestión de incidentes críticos, análisis de causa raíz (RCA) y mejora continua.
  • Deseable experiencia en iniciativas de FinOps y optimización de costos en la nube.

#babel

¿Qué ofrecemos?

Babel, the great way to achieve the success.

¿Quieres formar parte de un equipo en expansión, comprometido e innovador que hace historia cada día?  En Babel te acompañamos en tu camino hacia el éxito. Creemos en el talento de las personas y lo queremos potenciar.

Trabajar en Babel es mucho más que trabajar en una empresa, es unirse a un equipo de personas con una misión compartida y a un modelo de compañía centrado en valores.

Y lo hacemos promoviendo la diversidad, la equidad y la inclusión, garantizando la igualdad de oportunidades a todas las personas candidatas, en un entorno libre de cualquier tipo de discriminación.

Además,

  • Foco en trabajar con últimas tecnologías y proyectos innovadores, pero sobre todo, acompañamos a la transformación digital y acercamos la tecnología a la sociedad.
  • Comunicación y transparencia: Siempre estarás informado de las últimas noticias de la compañía.
  • Contribuimos a la formación constante de nuestros Babelievers.
  • Programa de promociones profesionales y desarrollo de talento.
  • Trabajo con proyectos de diversos países lo que nos permite aprender de diferentes culturas. 
  • Contribuimos en tu salud física y emocional (Charlas, competencias deportivas). 
  • Participamos del crecimiento de la compañía, reconocemos la participación de cada persona con nuestro bono solidario.
  • Apostamos por la flexibilidad laboral – personal. 
  • Bono por referidos.
  • Convenios comerciales según sede.

¿Aceptas el desafío? ¡Te esperamos!

En cumplimiento de la normativa vigente en materia de protección de datos te informamos que el responsable de tus datos personales es GRUPO BABEL (consultar empresas en la política de privacidad), y los utilizará para gestionar tus procesos de selección, tanto actuales como futuros y el resto de finalidades descritas en la web. Este tratamiento está basado en el consentimiento del candidato. Los datos personales recabados no serán en ningún caso cedidos a terceros salvo por obligaciones legales expresas. Puedes ejercer los derechos que te asisten sobre protección de datos en la dirección data.protection@babelgroup.com. Toda la información sobre política de privacidad en nuestra web.