Loading page content
Stefanini
Brasil

Especialista Devops

RemotoFull time
📍 BrasilRemotoPublicada 25 de agosto de 2026capturada em 25/08/2026
ANÁLISE DE COMPATIBILIDADE COM IA

Será que seu currículo passa pelo filtro desta vaga?

Envie seu CV e descubra, em segundos, sua compatibilidade real com Especialista Devops — o que já atende, e onde seu currículo pode estar perdendo aderência.

Incluído100% grátis
IncluídoResultado em segundos
IncluídoSem criar conta pra ver o preview
grátis · leva menos de 1 minuto

Descricao da vaga

No Grupo Stefanini, acreditamos no poder da colaboração. Co-criamos soluções inovadoras em parceria com nossos clientes, combinando tecnologia de ponta, inteligência artificial e a criatividade humana. Estamos na vanguarda da resolução de problemas de negócios, proporcionando impacto real em escala global.


Ao se juntar à Stefanini, você se torna parte de uma jornada global de transformação. Estamos empenhados em criar impacto positivo não apenas nos negócios, mas também na vida de nossos colaboradores. Se você procura uma oportunidade de crescimento profissional em uma empresa que valoriza inovação, respeito, autonomia e parceria, você encontra aqui!

Junte-se a nós e seja parte da mudança!



#LIREMOTE

#LI-SS1 

Responsabilidades e atribuicoes

Estamos em busca de uma Pessoa Engenheira SRE com foco em Observabilidade para atuar em ambientes críticos, garantindo alta disponibilidade, performance e confiabilidade de aplicações de missão crítica.

Você será uma das principais referências técnicas em observabilidade, trabalhando na evolução da estratégia de monitoramento, análise de incidentes e automação operacional, além de apoiar os times de engenharia na construção de uma cultura de excelência operacional e confiabilidade.


Principais responsabilidades

  • Projetar, implementar e evoluir a estratégia de observabilidade utilizando Datadog e ELK Stack (Elasticsearch + Kibana);
  • Estruturar e correlacionar métricas, logs e traces para troubleshooting e análise de causa raiz;
  • Definir e evoluir SLIs, SLOs, Error Budgets, dashboards e alertas inteligentes, reduzindo ruídos e acelerando a resolução de incidentes;
  • Atuar tecnicamente em incidentes críticos, conduzindo análises de causa raiz e propondo ações preventivas para evitar recorrências;
  • Apoiar squads de desenvolvimento na adoção das melhores práticas de SRE, DevOps, observabilidade e confiabilidade;
  • Automatizar atividades operacionais e processos utilizando Python;
  • Contribuir para a evolução contínua da plataforma, promovendo maior estabilidade, escalabilidade e eficiência operacional.


Requisitos

equisitos obrigatórios

  • Experiência sólida em Site Reliability Engineering (SRE) ou áreas correlatas;
  • Forte experiência com Datadog;
  • Experiência em análise de logs utilizando ELK Stack (Elasticsearch e Kibana);
  • Vivência com correlação entre métricas, logs e traces para identificação de causa raiz;
  • Experiência em ambientes de missão crítica, alta disponibilidade e alto volume transacional;
  • Conhecimento de práticas de observabilidade e monitoramento de aplicações.

Conhecimentos desejáveis

  • Cloud Computing, preferencialmente AWS;
  • Kubernetes;
  • Pipelines de CI/CD;
  • Infraestrutura como Código (Terraform);
  • Automação utilizando Python;
  • Conhecimento de aplicações Java em runtime e troubleshooting.

Será considerado um diferencial

  • Experiência com definição de SLIs, SLOs, Error Budgets e cultura SRE;
  • Experiência em ambientes Multi-Cloud;
  • Automação avançada de operações;
  • Conhecimento em Inteligência Artificial aplicada à observabilidade e operações (AIOps).


Curtiu a vaga? Veja se seu CV se encaixa.
Sobe seu currículo lá em cima e receba seu score em segundos.
Voltar ao topo
ALERTA DE VAGA CERTA
Quer receber vagas como essa antes da multidão do LinkedIn? De graça.
Criar conta grátis
SIMILARES
Outras vagas recentes
ver todas →