Site Reliability Engineer (SRE)

Empresa confidencial

Você é apaixonado(a) por confiabilidade, observabilidade e por entender o que está por trás da experiência digital de um cliente? Essa oportunidade pode ser para você. O Anderson Lopes, está buscando um(a) Site Reliability Engineer (SRE) para atuar em um ecossistema de alta complexidade, conectando tecnologia, confiabilidade e experiência do usuário em jornadas digitais críticas no setor de seguros. 🔎 O desafio envolve: - Evoluir a estratégia de Observabilidade; - Trabalhar com métricas, logs, traces e APM; - Definir e acompanhar SLIs, SLOs e indicadores de confiabilidade; - Criar dashboards, alertas e indicadores de saúde dos produtos; - Atuar em parceria com Engenharia, Infraestrutura, Arquitetura, Produto e Negócio; - Transformar dados técnicos em insights e recomendações para o negócio; - Liderar post-mortems e fomentar uma cultura de aprendizado e melhoria contínua. Buscamos profissionais com experiência em: SRE | Production Engineering | Platform Engineering, especialmente em ambientes distribuídos e modernos. Conhecimento em ferramentas como Datadog, Dynatrace, Prometheus, Grafana e OpenTelemetry será muito importante, assim como experiência com AWS, Azure ou GCP.

Requisitos

  • Experiência em SRE | Production Engineering | Platform Engineering
  • Experiência em ambientes distribuídos e modernos

Diferenciais

  • Conhecimento em ferramentas como Datadog, Dynatrace, Prometheus, Grafana e OpenTelemetry
  • Experiência com AWS, Azure ou GCP