Platform Engineer
SRE (Pleno).
Será que seu currículo passa pelo filtro desta vaga?
Envie seu CV e descubra, em segundos, sua compatibilidade real com Platform Engineer - SRE (Pleno) — o que já atende, e onde seu currículo pode estar perdendo aderência.
Descricao da vaga
🔎 #Conheça um pouco sobre a área:
O propósito do time de SRE é implementar e administrar a infraestrutura cloud AWS responsável pela hospedagem das nossas plataformas de GeoLocation, Go To Market Intelligence e de Reputação e Comunicação, utilizando IAC para implementação de infraestrutura, com confiabilidade e resiliência, apoiando as squads de desenvolvimento na operação e promovendo a cultura DevOps com uso de IA para apoio e evolução da operação.
Nosso objetivo é tratar a infraestrutura como um produtointerno e nosso maior desafio atual é construir e evoluir essa infraestrutura sobre Kubernetes (EKS), provendo automações e capacidades de operação self-service para que as squads implementem e escalem seus serviços com autonomia, segurança e velocidade — dentro de guardrails definidos pelo time de SRE.
Você vai atuar em um ambiente cloud AWS, com uma operação multi-cluster em K8S, usando GitOps (ArgoCD e Atlantis) como estratégia de entrega de aplicações e infraestrutura (Terraform), criando e operando ferramentas internas como camada de automação para os times de desenvolvimento. Participando e contribuindo nas decisões de arquitetura e foundation.
Responsabilidades e atribuicoes
🎯#Desafios que você vai encontrar:
- Implementar e operar workloads em clusters Kubernetes (EKS), aplicando boas práticas de operação, escalabilidade (Karpenter e Spot Instances), resiliência e monitoramento.
- Construir e evoluir automações para engenharia, incluindo catálogo de serviços e templates, reduzindo o caminho entre o código pronto e o serviço rodando em produção.
- Desenvolver e manter módulos Terraform reutilizáveis para provisionamento na AWS, buscando uma infraestrutura 100% imutável, versionada e revisada em fluxo GitOps.
- Evoluir a esteira de CI/CD, com entrega contínua via ArgoCD com deploys seguros, reversíveis e observáveis.
- Atuar em conjunto com os times de SRE no desenvolvimento de automações, ferramentas internas e aplicações que eliminem toil operacional e transformem demandas manuais de infraestrutura em self-service para as squads.
- Implementar estratégias e manter stack para monitoramento e observabilidade das aplicações e bancos de dados.
- Implementar guardrails de segurança e governança cloud como base das automações e fluxos de trabalho — sem comprometer a autonomia dos times.
- Atuar na resolução de incidentes de infraestrutura, contribuindo com a mitigação, a resposta e a análise de causa raiz, transformando aprendizados em melhorias da plataforma.
- Escrever e revisar código de infraestrutura, efetuar Code Review e Pair Programming, documentando decisões de arquitetura e padrões de uso da infraestrutura.
- Trabalhar em parceria com as squads de produto, desenvolvimento e infosec para garantir o alinhamento das soluções e o sucesso das entregas.
Requisitos
✔️ #Conhecimentos importantes para a posição:
- Experiência prática na implementação e operação de clusters Kubernetes (preferencialmente EKS). Vivência com Helm, escalabilidade, ingress/ALB, gestão de recursos e troubleshooting no K8S.
- Uso de IA no desenvolvimento de automações e aplicações internas e no apoio a operação, gerando maior eficiência na resolução de problemas e otimizações de ambiente.
- Sólidos conhecimentos em cloud AWS, especialmente em serviços de computação, rede, armazenamento, IAM e banco de dados.
- Experiência na implementação de infraestrutura na AWS com Terraform, escrevendo e evoluindo módulos reutilizáveis.
- Conhecimentos na implementação e operação de Bancos de Dados (preferencialmente Postgres, mongoDB ou Elasticsearch)
- Experiência na criação e evolução de pipelines de CI/CD e entrega contínua com ArgoCD em fluxo GitOps (experiência com ArgoCD é bem-vinda).
- Capacidade de desenvolver automações, scripts e aplicações em Python, Go e Bash, com boas práticas de versionamento e testes.
- Mentalidade de produto: enxergar o desenvolvedor como usuário de infraestrutura, se preocupar com a usabilidade e documentação do que entrega.
- Conhecimento de frameworks de boas práticas de operação e desenvolvimento, como 12 Factor e AWS Well-Architected. Boa noção de padrões de arquitetura de microsserviços e APIs REST.
- Capacidade de implementar, definir padrões e utilizar serviços de monitoramento e observabilidade, pensamento baseado em dados e métricas para resolução de problemas de performance e escalabilidade.
- Iniciativa para identificar problemas de infraestrutura e banco de dados, propor soluções baseadas em dados.
- Boa capacidade de comunicação e colaboração com os demais times de engenharia, compartilhando conhecimento e contribuindo na evolução de serviços com base nos conceitos DevOps e Cloud Native.
⭐ #Diferencial para a posição:
- Possui alguma certificação AWS;
- Experiência em times com a dinâmica de infraestrutura como produto (Platform Engineering);
- Já utilizou Backstage ou outro Internal Developer Portal na construção de golden paths e self-service.
- Já implementou estratégias para otimização de custos em cloud (FinOps).