SRE — Incidents & Monitoring (Sênior)

Empresa confidencial

🏢 remoto🎯 senior
Buscamos um(a) profissional sênior para atuar na linha de frente da resposta a incidentes, garantindo alta disponibilidade, reduzindo MTTR e evoluindo a estratégia de monitoramento e observabilidade da plataforma. O que esperamos: - Experiência sólida em SRE, DevOps ou Engenharia de Produção; - Domínio de Datadog, Grafana, Prometheus ou ferramentas similares; - Experiência com Cloud, gestão de incidentes e ambientes produtivos; - Automação com Python, Bash ou linguagem equivalente; - Inglês Avançado. Diferenciais: Kubernetes, Infrastructure as Code e certificações Cloud (AWS, GCP ou Azure).

Requisitos

  • Experiência sólida em SRE, DevOps ou Engenharia de Produção
  • Domínio de Datadog, Grafana, Prometheus ou ferramentas similares
  • Experiência com Cloud, gestão de incidentes e ambientes produtivos
  • Automação com Python, Bash ou linguagem equivalente
  • Inglês Avançado

Diferenciais

  • Kubernetes
  • Infrastructure as Code
  • Certificações Cloud (AWS, GCP ou Azure)