Sobre a oportunidade
Atuação em práticas de Site Reliability Engineering no time de Solutions Support, incluindo monitoramento proativo da saúde dos sistemas, apoio em resposta a incidentes, consultas em banco de dados SQL, automação de tarefas e manutenção de infraestrutura.
Responsabilidades
Atuar no monitoramento proativo da saúde dos sistemas, analisando métricas, logs e traces para identificar e antecipar possíveis problemas; Apoiar na resposta a incidentes, colaborando com a equipe para diagnosticar e resolver problemas em ambientes de produção, com foco na redução do tempo de recuperação (MTTR); Utilizar linguagem SQL para realizar consultas, rastrear dados e identificar inconsistências que ajudem no diagnóstico preciso dos incidentes; Apoiar na automação de tarefas manuais e repetitivas, contribuindo para a criação e manutenção de scripts e pipelines de CI/CD; Documentar os incidentes, as soluções aplicadas e os procedimentos operacionais em nossa base de conhecimento, garantindo o compartilhamento de informações; Colaborar com as equipes de desenvolvimento para integrar práticas de confiabilidade desde as fases iniciais dos projetos; Aprender e aplicar conceitos de Infraestrutura como Código (IaC) para provisionar e gerenciar a infraestrutura de forma automatizada.
Requisitos
- graduação em andamento ou concluída em Análise de Sistemas, Ciência da Computação ou correlatos
- lógica de programação e orientação a objetos
- SQL e Linux/Unix. Diferencial: Python/C#, CI/CD, cloud, Docker/Kubernetes, inglês ou espanhol básico.
Tecnologias
- Python
- Docker
- Kubernetes
- C#
- SQL
- AWS
- PostgreSQL
- Terraform
A candidatura abre fora do Tech Jobs.
A Tech Jobs não cobra para participar de processos seletivos. Desconfie de solicitações de pagamento ou dados sensíveis.
