Líder Técnico SRE y Observabilidad
Talycap Global Bogota, RAP (Especial) Central, Colombia
IT Services and IT Consulting · 51-200 employees
About the role
The Technical Lead will define and implement observability and reliability strategies for hybrid and multicloud platforms. They are responsible for driving proactive monitoring, incident management, automation, and continuous improvement to ensure system stability and performance.
What they look for
Requirements
Candidates must hold a professional degree in Systems, Software, or Electronic Engineering with 5-6 years of experience in IT operations or software engineering. At least 2 years of specific experience in SRE, observability, performance engineering, and automation is required.
Full description
🎯 Objetivo del Cargo
Buscamos un Líder Técnico SRE y Observabilidad para participar en un proyecto de alto impacto, liderando la definición e implementación de estrategias de observabilidad y confiabilidad de plataformas. Será responsable de impulsar prácticas de monitoreo proactivo, gestión de incidentes, automatización y mejora continua, contribuyendo a la disponibilidad, estabilidad y rendimiento de entornos tecnológicos híbridos y multicloud.
✅ Requisitos Indispensables
Formación Académica
- Profesional en Ingeniería de Sistemas.
- Profesional en Ingeniería de Software.
- Profesional en Ingeniería Electrónica.
- Carreras afines.
Experiencia
- Entre 5 y 6 años de experiencia en infraestructura, operaciones TI, plataformas o ingeniería de software.
- Mínimo 2 años en roles relacionados con SRE (Site Reliability Engineering).
- Mínimo 2 años en roles relacionados con Observability.
- Mínimo 2 años en Reliability Engineering o Performance Engineering.
- Mínimo 2 años de experiencia en automatización.
- Experiencia en liderazgo técnico.
- Experiencia coordinando iniciativas o células de trabajo.
⚙️ Conocimientos Técnicos Indispensables
Observabilidad
- Diseño e implementación de estrategias de observabilidad.
- Monitoreo end-to-end.
- Observabilidad en entornos híbridos.
- Observabilidad en entornos multicloud.
- Gestión de métricas.
- Gestión de logs.
- Gestión de trazas.
- Monitoreo proactivo.
Herramientas de Observabilidad
- Experiencia en al menos una de las siguientes:
- Dynatrace.
- Datadog.
- New Relic.
- Prometheus.
- Grafana.
SRE
- SLI.
- SLO.
- SLA.
- Incident Management.
- Problem Management.
- Root Cause Analysis (RCA).
- Capacity Planning.
- Error Budgets.
- Capacidad para definir e implementar prácticas SRE.
Cloud
- AWS.
- Azure.
Automatización
- Automatización operativa.
- Self-Healing.
⭐ Conocimientos Deseables
Certificaciones
- SRE Foundation.
- SRE Practitioner.
- Dynatrace.
- Datadog.
- New Relic.
- Prometheus.
- Grafana.
- AWS.
- Azure.
Performance Engineering
- Pruebas de carga.
- Pruebas de estrés.
- Chaos Engineering.
SAP
- SAP RISE.
- SAP Clean Core.
- SAP Activate.
- SAP Basis Cloud.
Similar roles
-
Site Reliability Engineer - Lisbon
Capital on Tap Lisbon, Portugal
-
Site Reliability Engineer
Fortress Information Security Washington, District of Columbia, United States · $160K–$180K/yr
-
Senior Site Reliability Engineer
Fortress Information Security Orlando, Florida, United States · $160K–$180K/yr
-
Site Reliability Engineer, Emerging Technology
Apple Singapore
-
Head - SRE
FIRY Bengaluru, Karnataka, India
-
Head - SRE
Skillz Inc Bengaluru, Karnataka, India