Software Technical Leader - SRE Eventos
Mercado Libre Governador Valadares, Southeast, Brazil
Internet Publishing · 10,001+ employees
About the role
Lead technical operations for high-traffic events, ensuring operational readiness and resilience through robust contingency planning. Drive strategic initiatives to improve system reliability, automate recovery processes, and manage incident responses.
What they look for
Requirements
Requires solid experience in SRE, DevOps, or Platform Engineering with at least two years in technical leadership or critical initiative management. Proficiency in distributed systems, cloud infrastructure, container orchestration, and modern observability tools is essential.
Full description
Como Software Technical Leader no Mercado Livre, você projetará e escalará sistemas inovadores e seguros que resolvem problemas reais e de alto impacto. Trabalhará em um ambiente dinâmico com tecnologia de ponta, aplicando boas práticas de engenharia, modelos próprios de IA e aprendizado contínuo, com o propósito de democratizar o comércio eletrônico e os serviços financeiros na América Latina.
Imagine você empreendendo projetos desafiadores, dinâmicos e inovadores, e sendo responsável por:
- Assumir a liderança técnica da operação de eventos de alto tráfego, garantindo prontidão operacional (validação de capacidade, planos de contingência, critérios de qualidade para entrada em produção) e evolução contínua da confiabilidade em cenários críticos.
- Conectar Produtos (Marketing), Engenharia e Infraestrutura, traduzindo necessidades comerciais em requisitos técnicos claros, viáveis e operáveis.
- Liderar iniciativas estratégicas de resiliência, reduzindo indisponibilidades e conduzindo a resposta técnica a incidentes e degradações, incluindo decisão, comunicação e recuperação segura dos serviços.
- Evoluir observabilidade, detecção de falhas e recuperação automatizada (self-healing), reduzindo a dependência de intervenções manuais.
- Atuar como referência técnica para as equipes de engenharia, promovendo arquitetura resiliente e escalável e fortalecendo uma cultura compartilhada de confiabilidade e prontidão operacional, do planejamento ao pós-evento.
O que buscamos em você?
- Possuir experiência sólida em SRE, DevOps, Engenharia de Plataforma ou função técnica equivalente, acumulando pelo menos dois anos em liderança técnica ou gestão de iniciativas críticas (coordenação de resposta, decisão sob pressão, comunicação executiva e post-mortems).
- Demonstrar conhecimento aprofundado de sistemas distribuídos, infraestrutura em nuvem (AWS, GCP, entre outros) e orquestração de contêineres com Kubernetes.
- Apresentar proficiência em Go, Java ou Python, além de experiência prática em ferramentas de versionamento como GitHub.
- Dominar ferramentas de observabilidade e monitoramento, tais como Datadog, Grafana, Kibana e New Relic.
- Evidenciar capacidade para liderar tecnicamente iniciativas multidisciplinares, influenciar decisões de arquitetura e articular equipes em cenários de alta criticidade.
- Contar com experiência em IA generativa/LLMs aplicada ao ciclo de desenvolvimento (automação, revisão de código, análise de incidentes) e histórico de melhoria de confiabilidade e resiliência com redução de MTTD/MTTR (Diferencial).
Você se anima a deixar sua marca na tecnologia da América Latina?
Candidate-se e junte-se ao nosso propósito!
Modalidade de trabalho híbrida. Escritório Osasco, SP.
Similar roles
-
Site Reliability Engineer, Kubernetes Platform (Top Secret Clearance)
SpaceX Hawthorne, California, United States · $145K–$195K/yr
-
Senior Site Reliability Engineer
GFT Technologies SE Ho Chi Minh City, Vietnam
-
Senior Software Engineer SRE - Connectivity
General Motors Warren, Michigan, United States
-
Sr. Site Reliability Administrator
Open Text Corporation Mississauga, Ontario, Canada · CA$92K–CA$138K/yr
-
Site Reliability Engineer
Avalara Romania
-
Principal Engineer - Database Platform Engineering & SRE
Lumen Technologies United States · $152K–$223K/yr