Talycap Global

Líder Técnico SRE y Observabilidad

Talycap Global Bogota, RAP (Especial) Central, Colombia

IT Services and IT Consulting · 51-200 employees

Sep 09
sre Senior (5-10 yrs) Full-time Colombia
Create a free account to apply — email only, no card. You can also save this posting or score it against your profile with AI.

About the role

The Technical Lead will define and implement observability and reliability strategies for hybrid and multicloud platforms. They are responsible for driving proactive monitoring, incident management, automation, and continuous improvement to ensure system stability and performance.

What they look for

Site Reliability Engineering Observability Cloud Computing AWS Azure Dynatrace Datadog New Relic Prometheus Grafana Incident Management Automation Performance Engineering Chaos Engineering Capacity Planning Technical Leadership

Requirements

Candidates must hold a professional degree in Systems, Software, or Electronic Engineering with 5-6 years of experience in IT operations or software engineering. At least 2 years of specific experience in SRE, observability, performance engineering, and automation is required.

Full description

🎯 Objetivo del Cargo

Buscamos un Líder Técnico SRE y Observabilidad para participar en un proyecto de alto impacto, liderando la definición e implementación de estrategias de observabilidad y confiabilidad de plataformas. Será responsable de impulsar prácticas de monitoreo proactivo, gestión de incidentes, automatización y mejora continua, contribuyendo a la disponibilidad, estabilidad y rendimiento de entornos tecnológicos híbridos y multicloud.

✅ Requisitos Indispensables

Formación Académica

  • Profesional en Ingeniería de Sistemas.
  • Profesional en Ingeniería de Software.
  • Profesional en Ingeniería Electrónica.
  • Carreras afines.

Experiencia

  • Entre 5 y 6 años de experiencia en infraestructura, operaciones TI, plataformas o ingeniería de software.
  • Mínimo 2 años en roles relacionados con SRE (Site Reliability Engineering).
  • Mínimo 2 años en roles relacionados con Observability.
  • Mínimo 2 años en Reliability Engineering o Performance Engineering.
  • Mínimo 2 años de experiencia en automatización.
  • Experiencia en liderazgo técnico.
  • Experiencia coordinando iniciativas o células de trabajo.

⚙️ Conocimientos Técnicos Indispensables

Observabilidad

  • Diseño e implementación de estrategias de observabilidad.
  • Monitoreo end-to-end.
  • Observabilidad en entornos híbridos.
  • Observabilidad en entornos multicloud.
  • Gestión de métricas.
  • Gestión de logs.
  • Gestión de trazas.
  • Monitoreo proactivo.

Herramientas de Observabilidad

  • Experiencia en al menos una de las siguientes:
  • Dynatrace.
  • Datadog.
  • New Relic.
  • Prometheus.
  • Grafana.

SRE

  • SLI.
  • SLO.
  • SLA.
  • Incident Management.
  • Problem Management.
  • Root Cause Analysis (RCA).
  • Capacity Planning.
  • Error Budgets.
  • Capacidad para definir e implementar prácticas SRE.

Cloud

  • AWS.
  • Azure.

Automatización

  • Automatización operativa.
  • Self-Healing.

⭐ Conocimientos Deseables

Certificaciones

  • SRE Foundation.
  • SRE Practitioner.
  • Dynatrace.
  • Datadog.
  • New Relic.
  • Prometheus.
  • Grafana.
  • AWS.
  • Azure.

Performance Engineering

  • Pruebas de carga.
  • Pruebas de estrés.
  • Chaos Engineering.

SAP

  • SAP RISE.
  • SAP Clean Core.
  • SAP Activate.
  • SAP Basis Cloud.

Similar roles