Reclame AQUI

Engenheiro de Confiabilidade Pleno - SRE

🌍 Remoto📍 Remoto
PUBLICIDADE

Descrição da Vaga

No Reclame AQUI, você atuará como Engenheiro de Confiabilidade Pleno (SRE), contribuindo para a estabilidade, previsibilidade e performance da maior plataforma de confiança do país. A missão é escalar a infraestrutura com previsibilidade e transformar a monitoração em uma aliada da experiência do usuário, em um momento de expansão global da empresa.

Responsabilidades

  • Apoiar o time no dimensionamento e refinamento técnico de tarefas de SRE nas cerimônias da sprint, garantindo entregas consistentes e previsíveis.
  • Implementar rotinas preditivas para reduzir e evitar falhas simples, evoluindo o monitoramento para os Golden Signals (Latência, Erro, Tráfego e Saturação) com o objetivo de antecipar impactos na jornada do consumidor.
  • Apoiar ativamente a definição e o cumprimento de SLOs e SLAs das squads, acompanhando os Error Budgets para equilibrar a velocidade de deploy com a estabilidade do sistema.
  • Colaborar na evolução do FAÍSCA (portal baseado em Backstage), desenvolvendo templates e automatizando o provisionamento de recursos (como buckets, bancos e microsserviços) para eliminar a fricção operacional dos desenvolvedores.
  • Realizar o troubleshoot e o ajuste fino de workloads no K8s, tratando problemas de recursos de forma ágil (como CPU, memória, storage) e atuando diretamente na contenção de gargalos como DiskPressure.
  • Participar ativamente de rituais de post-mortem, focando no aprendizado técnico, na correção de processos e no fortalecimento da segurança psicológica do time para reportar erros e aprender com eles.
  • Desenvolver, modularizar, versionar e manter códigos em Terraform, garantindo que a infraestrutura na GCP seja segura, padronizada e reprodutível.
  • Auxiliar no controle de custos e desperdício de nuvem, apoiando o monitoramento do faturamento na GCP e a eficiência das ferramentas de escalabilidade inteligente (como Spotinst Ocean).
  • Mapear tarefas operacionais repetitivas no dia a dia da infraestrutura e desenvolver scripts (Python ou Golang) para eliminá-las, liberando o time para atuações mais estratégicas.
PUBLICIDADE

Requisitos

  • Experiência prática consistente atuando como SRE, DevOps ou Engenheiro(a) de Infraestrutura.
  • Domínio de Kubernetes, incluindo gerenciamento de pods, troubleshoot diário de workloads, Helm Charts e ciclo de vida de containers.
  • Vivência em Cloud (GCP) com os principais serviços da Google Cloud Platform.
  • Prática no desenvolvimento de IaC com Terraform e habilidade para escrever scripts utilitários em Python ou Golang.
  • Familiaridade com pipelines de integração e entrega contínua (CI/CD), utilizando ferramentas como Argo CD e Bitbucket.
  • Prática na configuração de métricas, alertas e painéis utilizando Prometheus e Grafana.
  • Boa comunicação para atuar de forma cross-functional com desenvolvedores.
  • Conhecimento prático ou forte interesse em portais internos baseados em Backstage.
  • Noções de FinOps e análise de consumo de recursos em nuvem (GCP / Flexera / Spotinst).
  • Vivência com redes em nuvem (VPC, Cloud Ingress, Service Mesh).
  • Familiaridade com monitoramento e operação de bancos de dados gerenciados (como MongoDB Atlas).

Somos os verdadeiros heróis sem capa. Bom, o que fazemos? É simples! Nós estamos mudando o mundo! Longe desse papo de empresa que quer impressionar (Deus me livre, mas quem me dera rsrs), porém, AQUI isso é uma verdade todos os dias, MUDAR O MUNDO.[Ver Mais]

Informações Adicionais

Selecionamos as principais informações da posição. Para conferir o descritivo completo, clique em "acessar"
PUBLICIDADE
Candidatar-se a esta vaga →

Você será redirecionado para o site da empresa

PUBLICIDADE