Senior Site Reliability Engineering (SRE)
Skeelo Brazil
Entertainment Providers · 51-200 employees
About the role
You will be responsible for structuring and optimizing SRE processes, monitoring, and automation to ensure system stability and performance. Additionally, you will lead incident resolution and prepare infrastructure for high-demand scenarios.
What they look for
Requirements
The role requires proven experience in structuring infrastructure or SRE areas, particularly in high-volume, mission-critical environments. Candidates must possess deep knowledge of end-to-end monitoring, automation, and advanced English proficiency.
Benefits
Full description
O time de Engenharia da squad de Infraestrutura está precisando de alguém, e queremos você com a gente! Sua missão? Você será a pessoa chave para garantir a estabilidade e a performance de nossos sistemas, especialmente em cenários de alta demanda, e nos ajudar a escalar.
O seu dia a dia no Skeelo vai ser assim:
- Estruturar e otimizar a área de SRE e monitoramento, definindo processos, boas práticas e ferramentas.
- Desenvolver e manter monitoramento abrangente de toda a stack (infraestrutura, serviços, filas e performance).
- Atuar na identificação de causa raiz e resolução de incidentes, garantindo rápida recuperação dos serviços.
- Criar e evoluir automação e alertas, com detecção de anomalias e ações corretivas automatizadas.
- Garantir alta disponibilidade, performance e escalabilidade, preparando a infraestrutura para picos de demanda.
- Avaliar e evoluir o stack tecnológico, incluindo adoção de novas soluções (como IA) e, futuramente, apoio no desenvolvimento do time.
Para isso você vai precisar ter:
- Experiência comprovada na estruturação de áreas de infraestrutura/SRE, preferencialmente em ambientes de alto volume e missão crítica.
- Conhecimento profundo em monitoramento de ponta a ponta (infraestrutura, serviços e aplicações).
- Habilidade em automação de processos, criação de alertas e fluxos eficientes.
- Forte capacidade de resolução de problemas complexos e análise de causa raiz em ambientes distribuídos.
- Experiência com alta demanda e uso de IA aplicada a operações, além de inglês avançado para leitura e escrita.
E seria muito bom se você tivesse:
- Conhecimento avançado em Linux e experiência com ferramentas como Node.js, Kibana e Elasticsearch.
- Experiência com cloud pública (AWS, GCP ou Azure) e ambientes distribuídos.
- Vivência com monitoramento e escalabilidade, incluindo ferramentas de mercado e sistemas de alta demanda.
E os benefícios? A gente cuida bem de quem constrói isso aqui 💚
- Plano de saúde (sem custo e sem coparticipação para você e seus familiares) + odonto e seguro de vida
- VA/VR flexível no Caju (liberdade real de uso)
- Bem-estar completo: Totalpass (atividade física) + ZenKlub (saúde mental)
- PPR anual atrelado a metas e impacto
- Acesso ao Skeelo Premium + clube do livro com ebook do mês
- Auxílio creche + licença parental estendida
- Parceria com escolas de idiomas, Berlitz e Open English
- Feriados de SP emendados + recesso remunerado no fim do ano
- Day off de aniversário
Quer ver tudo com mais detalhes? Dá uma olhada na nossa página de carreiras:
https://skeelo.com/pt/carreiras/
DEU MATCH? ENTÃO VEM CÁ! 💚
Se você busca desenvolvimento e quer gerar impacto facilitando o acesso à leitura, vem construir sua carreira com a gente. Esse papel principal pode ser seu, está esperando o que para se inscrever? #ValeAPenaSerSkeeler
Similar roles
-
Site Reliability Engineer
Workiy Barrington, Rhode Island, United States
-
Site Reliability Developer 4
Oracle Austin, Texas, United States · $102K–$210K/yr
-
Senior Site Reliability Engineer
Cross River Fort Lee, New Jersey, United States · $160K–$200K/yr
-
Software Dev Senior Engineer – SRE & Cloud Reliability
SonicWall Pune, Maharashtra, India
-
Manager, Site Reliability Engineering (Auth0)
Okta Washington, District of Columbia, United States · $182K–$251K/yr
-
Site Reliability Engineer -Jersey City, NJ & Dallas, TX
StradIT Dallas, Texas, United States