Engenheiro de Confiabilidade de Site (SRE)
Empresa confidencial
🏢 remoto
Procuramos por um(a) Engenheiro de Confiabilidade de Site (SRE) para garantir a sustentação, estabilidade, disponibilidade e evolução de ambientes tecnológicos.
Requisitos Obrigatórios:
- Experiência prévia como SRE, DevOps Engineer ou em funções semelhantes
- Fortes habilidades em automação, monitoramento e resolução de incidentes
- Conhecimento em AWS, Azure e/ou GCP
- Conhecimento em Kubernetes e Docker
- Experiência com Linux e ferramentas de infraestrutura como código (Terraform ou similar)
- Implementação e manutenção de pipelines de CI/CD
- Proficiência no uso de Git
- Monitoramento e observabilidade com ferramentas como Grafana, Prometheus, Datadog e Dynatrace
- Conhecimentos em redes, APIs e ambientes distribuídos
- Automação com Python, Shell/Bash ou similares
Requisitos Desejáveis:
- Experiência em configuração e evolução de ferramentas de monitoramento e observabilidade
- Conhecimento em práticas de troubleshooting e análise de causa raiz para resolução de incidentes
- Experiência em apoiar times de desenvolvimento na construção de aplicações resilientes e escaláveis
- Familiaridade com metodologias ágeis e práticas de DevOps
Resumo dos
requisitos: Terraform, CI/CD, Git, Grafana, Prometheus, Datadog, Dynatrace, Python, Shell/Bash.Requisitos
- Experiência prévia como SRE, DevOps Engineer ou em funções semelhantes
- Fortes habilidades em automação, monitoramento e resolução de incidentes
- Conhecimento em AWS, Azure e/ou GCP
- Conhecimento em Kubernetes e Docker
- Experiência com Linux e ferramentas de infraestrutura como código (Terraform ou similar)
- Implementação e manutenção de pipelines de CI/CD
- Proficiência no uso de Git
- Monitoramento e observabilidade utilizando ferramentas como Grafana, Prometheus, Datadog e Dynatrace
- Conhecimentos em redes, APIs e ambientes distribuídos
- Automação com Python, Shell/Bash ou similares
Diferenciais
- Experiência em configuração e evolução de ferramentas de monitoramento e observabilidade
- Conhecimento em práticas de troubleshooting e análise de causa raiz para resolução de incidentes
- Experiência em apoiar times de desenvolvimento na construção de aplicações resilientes e escaláveis
- Familiaridade com metodologias ágeis e práticas de DevOps