Pular para o conteúdo principal

Site Reliability Engineer (SRE) | AWS | Kubernetes | Databricks | Sênior (Remote)

Descrição da vaga

.

Responsabilidades e atribuições

  • Garantir a confiabilidade, disponibilidade e desempenho de sistemas e aplicações em produção;
  • Projetar, implementar e evoluir automações para deploy, monitoramento, escalabilidade e operação da plataforma;
  • Administrar e evoluir ambientes Kubernetes, assegurando estabilidade e alta disponibilidade;
  • Responder a incidentes críticos, conduzindo análises de causa raiz (RCA) e implementando ações preventivas;
  • Definir, acompanhar e evoluir indicadores de confiabilidade, como SLIs, SLOs e SLAs;
  • Gerenciar e otimizar pipelines de CI/CD, promovendo entregas contínuas e seguras;
  • Implementar e manter infraestrutura como código (IaC), garantindo padronização e automação dos ambientes;
  • Desenvolver e fortalecer práticas de observabilidade, monitoramento, métricas e alertas;
  • Colaborar com equipes de desenvolvimento na construção de aplicações resilientes, escaláveis e de alta performance;
  • Documentar procedimentos operacionais, planos de contingência e boas práticas de operação;
  • Atuar na melhoria contínua da plataforma, reduzindo falhas recorrentes e aumentando a confiabilidade dos serviços.

Requisitos e qualificações

  • Experiência sólida como Site Reliability Engineer (SRE), DevOps Engineer ou Platform Engineer;
  • Vivência em administração de ambientes Kubernetes em produção;
  • Experiência com infraestrutura em cloud, preferencialmente AWS;
  • Conhecimento em automação de infraestrutura utilizando Terraform e Infrastructure as Code (IaC);
  • Experiência com pipelines CI/CD, processos de integração e entrega contínua;
  • Vivência com ferramentas de observabilidade, monitoramento e gestão de incidentes;
  • Experiência em troubleshooting de aplicações distribuídas e ambientes críticos de produção;
  • Experiência com Databricks e Apache Spark;
  • Experiência com AWS CodePipeline;
  • Conhecimento em bancos de dados SQL, Data Warehouse e modelagem de dados;
  • Experiência com Amazon EC2, Amazon S3 e AWS Lambda;
  • Conhecimento em arquitetura cloud e ambientes Microsoft Azure;
  • Conhecimento em práticas de alta disponibilidade, escalabilidade, resiliência e recuperação de incidentes;
  • Capacidade de atuar de forma analítica na identificação de causas raiz e implementação de melhorias contínuas;
  • Diferencial: Certificações Databricks.

Etapas do processo

  1. Etapa 1: Cadastro
  2. Etapa 2: Mapeamento de Stack
  3. Etapa 3: Fit Cultural
  4. Etapa 4: Entrevista Líder
  5. Etapa 5: Cadastro de Qualificação
  6. Etapa 6: Oferta e Negociação
  7. Etapa 7: Contratação

Become a Compasser, be part of AI/R.

Compass UOL is a global firm and part of the AI Revolution Company, together transforming organizations using Artificial Intelligence, Generative AI, and other of today’s most advanced technologies.


We equip our team with proprietary and external AI-driven tools to design and build digital-native platforms, integrating cutting-edge technologies and enabling companies to innovate, transform their businesses, and drive success in their markets.

To achieve this, we attract and develop the best talent, creating opportunities that enhance people’s lives and highlight the positive impact of disruptive technologies.

We empower borderless talent and promote knowledge and opportunities in the latest market trends, driving significant personal and professional growth.

Join us and be part of the AI-driven revolution.