PUBLICIDADE
Descrição da Vaga
No Reclame AQUI, você atuará como Engenheiro de Confiabilidade Pleno (SRE), contribuindo para a estabilidade, previsibilidade e performance da maior plataforma de confiança do país. A missão é escalar a infraestrutura com previsibilidade e transformar a monitoração em uma aliada da experiência do usuário, em um momento de expansão global da empresa.
Responsabilidades
- Apoiar o time no dimensionamento e refinamento técnico de tarefas de SRE nas cerimônias da sprint, garantindo entregas consistentes e previsíveis.
- Implementar rotinas preditivas para reduzir e evitar falhas simples, evoluindo o monitoramento para os Golden Signals (Latência, Erro, Tráfego e Saturação) com o objetivo de antecipar impactos na jornada do consumidor.
- Apoiar ativamente a definição e o cumprimento de SLOs e SLAs das squads, acompanhando os Error Budgets para equilibrar a velocidade de deploy com a estabilidade do sistema.
- Colaborar na evolução do FAÍSCA (portal baseado em Backstage), desenvolvendo templates e automatizando o provisionamento de recursos (como buckets, bancos e microsserviços) para eliminar a fricção operacional dos desenvolvedores.
- Realizar o troubleshoot e o ajuste fino de workloads no K8s, tratando problemas de recursos de forma ágil (como CPU, memória, storage) e atuando diretamente na contenção de gargalos como DiskPressure.
- Participar ativamente de rituais de post-mortem, focando no aprendizado técnico, na correção de processos e no fortalecimento da segurança psicológica do time para reportar erros e aprender com eles.
- Desenvolver, modularizar, versionar e manter códigos em Terraform, garantindo que a infraestrutura na GCP seja segura, padronizada e reprodutível.
- Auxiliar no controle de custos e desperdício de nuvem, apoiando o monitoramento do faturamento na GCP e a eficiência das ferramentas de escalabilidade inteligente (como Spotinst Ocean).
- Mapear tarefas operacionais repetitivas no dia a dia da infraestrutura e desenvolver scripts (Python ou Golang) para eliminá-las, liberando o time para atuações mais estratégicas.
PUBLICIDADE
Requisitos
- ✓Experiência prática consistente atuando como SRE, DevOps ou Engenheiro(a) de Infraestrutura.
- ✓Domínio de Kubernetes, incluindo gerenciamento de pods, troubleshoot diário de workloads, Helm Charts e ciclo de vida de containers.
- ✓Vivência em Cloud (GCP) com os principais serviços da Google Cloud Platform.
- ✓Prática no desenvolvimento de IaC com Terraform e habilidade para escrever scripts utilitários em Python ou Golang.
- ✓Familiaridade com pipelines de integração e entrega contínua (CI/CD), utilizando ferramentas como Argo CD e Bitbucket.
- ✓Prática na configuração de métricas, alertas e painéis utilizando Prometheus e Grafana.
- ✓Boa comunicação para atuar de forma cross-functional com desenvolvedores.
- •Conhecimento prático ou forte interesse em portais internos baseados em Backstage.
- •Noções de FinOps e análise de consumo de recursos em nuvem (GCP / Flexera / Spotinst).
- •Vivência com redes em nuvem (VPC, Cloud Ingress, Service Mesh).
- •Familiaridade com monitoramento e operação de bancos de dados gerenciados (como MongoDB Atlas).
Categorias
Sobre a Empresa
Mais vagas na Reclame AQUI →Somos os verdadeiros heróis sem capa. Bom, o que fazemos? É simples! Nós estamos mudando o mundo! Longe desse papo de empresa que quer impressionar (Deus me livre, mas quem me dera rsrs), porém, AQUI isso é uma verdade todos os dias, MUDAR O MUNDO.[Ver Mais]
Informações Adicionais
Selecionamos as principais informações da posição. Para conferir o descritivo completo, clique em "acessar"
PUBLICIDADE
Candidatar-se a esta vaga →
Você será redirecionado para o site da empresa
Vagas Relacionadas
PUBLICIDADE