Analista de SRE Pleno

RD Station

🏢 remoto🎯 pleno
Suas principais entregas: - Apoiar e aprender a operar e provisionar workloads críticos (Redis, Elasticsearch, filas, bancos, etc.) em ambientes de larga escala; - Contribuir na implementação e melhoria de automação e Infraestrutura como Código (IaC), fazendo updates supervisionados em projetos de infraestrutura (ex: TF Projects); - Colaborar na observabilidade dos sistemas, aprendendo a usar ferramentas (como Datadog) para criar dashboards, configurar alertas e analisar logs, métricas e tracing; - Participar ativamente de atividades de troubleshooting, gestão de incidentes e análise de causa raiz, promovendo a confiabilidade dos produtos; - Aprender e aplicar padrões de engenharia, SLOs, SLIs e boas práticas de SRE para tornar a infraestrutura mais simples, rápida e segura. Perfil que buscamos: - Experiência com ambientes Linux; - Experiência com Git; - Experiência avançada com provedores Cloud (GCP e AWS obrigatoriamente; Azure recomendável); - Experiência com orquestração de containers (Kubernetes); - Entendimento intermediário de pipelines de CI/CD; - Capacidade de leitura e entendimento de código para compreender lógica de scripts e aplicações; - Conhecimento dos conceitos de observabilidade, automação, monitoração e engenharia de software; - Perfil analítico e pró-ativo para aperfeiçoar habilidades técnicas e acompanhar engenheiros JR; - Conhecimento de ferramentas de Infraestrutura como Código (IaC). Será considerado um diferencial: - Certificações AWS, GCP, LPI; - Noções de linguagens de programação e/ou scripting; - Conhecimento em ferramentas e métricas de observabilidade; - Experiência com monitoramento de sistemas, especialmente com Datadog ou similares; - Conhecimento intermediário de redes (TCP/IP, DNS, load balancing, VPC); - Vivência ou participação prévia em resolução de incidentes. Etapas do processo seletivo: - Aplicação - Envio da inscrição; - Mindsight – Teste de estilo de trabalho; - Talent Acquisition - Entrevista por competência com o time de recrutamento; - Desafio Técnico – Teste de avaliação de habilidades técnicas; - Entrevista Final - Conversa final com a gerência para alinhamento; - Offer - Fase de conclusão do processo seletivo, com a apresentação da proposta de trabalho. Obs: Podem ter etapas complementares e/ou alterações, de acordo com a necessidade do processo.

Requisitos

  • Experiência com ambientes Linux
  • Experiência com Git
  • Experiência avançada com provedores Cloud (GCP e AWS obrigatoriamente; Azure recomendável)
  • Experiência com orquestração de containers (Kubernetes)
  • Entendimento intermediário de pipelines de CI/CD
  • Capacidade de leitura e entendimento de código para compreender lógica de scripts e aplicações
  • Conhecimento dos conceitos de observabilidade, automação, monitoração e engenharia de software
  • Perfil analítico e pró-ativo para aperfeiçoar habilidades técnicas e acompanhar engenheiros JR
  • Conhecimento de ferramentas de Infraestrutura como Código (IaC)

Diferenciais

  • Certificações AWS, GCP, LPI
  • Noções de linguagens de programação e/ou scripting
  • Conhecimento em ferramentas e métricas de observabilidade
  • Experiência com monitoramento de sistemas, especialmente com Datadog ou similares
  • Conhecimento intermediário de redes (TCP/IP, DNS, load balancing, VPC)
  • Vivência ou participação prévia em resolução de incidentes