Sobre a oportunidade
#Conheça um pouco sobre a área: O propósito do time de SRE é implementar e administrar a infraestrutura cloud AWS responsável pela hospedagem das nossas plataformas de GeoLocation, Go To Market Intelligence e de Reputação e Comunicação, utilizando IAC para implementação de infraestrutura, com confiabilidade e resiliência, apoiando as squads de desenvolvimento na operação e promovendo a cultura DevOps com uso de IA para apoio e evolução da operação. Nosso objetivo é tratar a infraestrutura como um produtointerno e nosso maior desafio atual é construir e evoluir essa infraestrutura sobre Kubernetes (EKS), provendo automações e capacidades de operação self-service para que as squads implementem e escalem seus serviços com autonomia, segurança e velocidade — dentro de guardrails definidos pelo time de SRE. Você vai atuar em um ambiente cloud AWS, com uma operação multi-cluster em K8S, usando GitOps (ArgoCD e Atlantis) como estratégia de entrega de aplicações e infraestrutura (Terraform), criando e operando ferramentas internas como camada de automação para os times de desenvolvimento. Participando e contribuindo nas decisões de arquitetura e foundation.
Responsabilidades
#Desafios que você vai encontrar: Implementar e operar workloads em clusters Kubernetes (EKS), aplicando boas práticas de operação, escalabilidade (Karpenter e Spot Instances), resiliência e monitoramento. Construir e evoluir automações para engenharia, incluindo catálogo de serviços e templates, reduzindo o caminho entre o código pronto e o serviço rodando em produção. Desenvolver e manter módulos Terraform reutilizáveis para provisionamento na AWS, buscando uma infraestrutura 100% imutável, versionada e revisada em fluxo GitOps. Evoluir a esteira de CI/CD, com entrega contínua via ArgoCD com deploys seguros, reversíveis e observáveis. Atuar em conjunto com os times de SRE no desenvolvimento de automações, ferramentas internas e aplicações que eliminem toil operacional e transformem demandas manuais de infraestrutura em self-service para as squads. Implementar estratégias e manter stack para monitoramento e observabilidade das aplicações e bancos de dados. Implementar guardrails de segurança e governança cloud como base das automações e fluxos de trabalho — sem comprometer a autonomia dos times. Atuar na resolução de incidentes de infraestrutura, contribuindo com a mitigação, a resposta e a análise de causa raiz, transformando aprendizados em melhorias da plataforma. Escrever e revisar código de infraestrutura, efetuar Code Review e Pair Programming, documentando decisões de arquitetura e padrões de uso da infraestrutura. Trabalhar em parceria com as squads de produto, desenvolvimento e infosec para garantir o alinhamento das soluções e o sucesso das entregas.