Engenheiro de Confiabilidade de Site (SRE)

Empresa confidencial

🏢 remoto
Procuramos por um(a) Engenheiro de Confiabilidade de Site (SRE) para garantir a sustentação, estabilidade, disponibilidade e evolução de ambientes tecnológicos. Requisitos Obrigatórios: - Experiência prévia como SRE, DevOps Engineer ou em funções semelhantes - Fortes habilidades em automação, monitoramento e resolução de incidentes - Conhecimento em AWS, Azure e/ou GCP - Conhecimento em Kubernetes e Docker - Experiência com Linux e ferramentas de infraestrutura como código (Terraform ou similar) - Implementação e manutenção de pipelines de CI/CD - Proficiência no uso de Git - Monitoramento e observabilidade com ferramentas como Grafana, Prometheus, Datadog e Dynatrace - Conhecimentos em redes, APIs e ambientes distribuídos - Automação com Python, Shell/Bash ou similares Requisitos Desejáveis: - Experiência em configuração e evolução de ferramentas de monitoramento e observabilidade - Conhecimento em práticas de troubleshooting e análise de causa raiz para resolução de incidentes - Experiência em apoiar times de desenvolvimento na construção de aplicações resilientes e escaláveis - Familiaridade com metodologias ágeis e práticas de DevOps Resumo dos requisitos: Terraform, CI/CD, Git, Grafana, Prometheus, Datadog, Dynatrace, Python, Shell/Bash.

Requisitos

  • Experiência prévia como SRE, DevOps Engineer ou em funções semelhantes
  • Fortes habilidades em automação, monitoramento e resolução de incidentes
  • Conhecimento em AWS, Azure e/ou GCP
  • Conhecimento em Kubernetes e Docker
  • Experiência com Linux e ferramentas de infraestrutura como código (Terraform ou similar)
  • Implementação e manutenção de pipelines de CI/CD
  • Proficiência no uso de Git
  • Monitoramento e observabilidade utilizando ferramentas como Grafana, Prometheus, Datadog e Dynatrace
  • Conhecimentos em redes, APIs e ambientes distribuídos
  • Automação com Python, Shell/Bash ou similares

Diferenciais

  • Experiência em configuração e evolução de ferramentas de monitoramento e observabilidade
  • Conhecimento em práticas de troubleshooting e análise de causa raiz para resolução de incidentes
  • Experiência em apoiar times de desenvolvimento na construção de aplicações resilientes e escaláveis
  • Familiaridade com metodologias ágeis e práticas de DevOps