Barueri - SP

1 posição

Elegível para PCD

A Proative Technology é especialista em serviços gerenciados de TI e acredita que pessoas incríveis constroem empresas extraordinárias. Somos reconhecidos como Great Place to Work, reforçando nosso compromisso com um ambiente colaborativo, inclusivo e orientado ao desenvolvimento.

Se você busca atuar em ambientes de alta disponibilidade, contribuindo para a confiabilidade dos serviços e apoiando a evolução tecnológica das operações, a Proative é o lugar certo para você.

Estamos em busca de um Site Reliability Engineer (SRE) para atuar na sustentação, monitoramento e evolução de ambientes críticos, garantindo a disponibilidade, performance e confiabilidade dos serviços.

Procuramos um profissional com perfil analítico, foco em automação e melhoria contínua, capaz de atuar na prevenção e resolução de incidentes e na construção de ambientes cada vez mais resilientes, escaláveis e alinhados às necessidades do negócio.

Responsabilidades
  • Monitorar a disponibilidade, desempenho e saúde dos ambientes e aplicações;
  • Atuar na identificação, análise e resolução de incidentes, minimizando impactos ao negócio;
  • Desenvolver e implementar automações para otimização de processos operacionais;
  • Administrar e sustentar ambientes cloud e infraestrutura crítica;
  • Configurar e evoluir soluções de observabilidade, monitoramento, métricas, logs e alertas;
  • Participar da definição e acompanhamento de indicadores de confiabilidade, disponibilidade e performance;
  • Apoiar equipes de desenvolvimento na construção de aplicações resilientes e escaláveis;
  • Realizar análise de causa raiz (RCA) e propor melhorias contínuas para prevenção de incidentes;
  • Contribuir para a evolução das práticas de confiabilidade, estabilidade e eficiência operacional.
Qualificações Necessárias
  • Ensino superior completo em Tecnologia da Informação, Engenharia, Ciência da Computação ou áreas correlatas;
  • Experiência prévia em funções relacionadas a SRE, DevOps, Cloud ou Infraestrutura;
  • Conhecimento sólido em Linux;
  • Experiência com ambientes Cloud (AWS, Azure ou GCP);
  • Vivência em troubleshooting e gestão de incidentes em ambientes produtivos;
  • Perfil analítico e orientado à resolução de problemas.
Conhecimentos Técnicos
  • Experiência com ambientes AWS, Azure ou GCP;
  • Conhecimento em Linux e administração de ambientes produtivos;
  • Experiência com Docker e Kubernetes;
  • Conhecimento em ferramentas de observabilidade, monitoramento, métricas e logs;
  • Experiência com soluções como Grafana, Prometheus, Datadog, Zabbix ou similares;
  • Vivência com automação de infraestrutura e Infrastructure as Code (Terraform, Ansible ou similares);
  • Conhecimento em pipelines CI/CD;
  • Experiência em troubleshooting e gestão de incidentes em ambientes produtivos;
  • Conhecimento em SLI, SLO, SLA e Error Budget;
  • Conhecimento em redes, segurança e arquitetura de ambientes cloud.
Desejável
  • Certificações Cloud (AWS, Azure ou GCP);
  • Experiência com GitOps;
  • Conhecimento em SLI, SLO, SLA e Error Budget;
  • Vivência em ambientes de alta disponibilidade e missão crítica;
  • Conhecimento em segurança de ambientes cloud e containers;
  • Experiência com práticas de confiabilidade e melhoria contínua.

Requisitos

Escolaridade

  • MBA
  • Pós Graduação
  • Graduação

Idioma

  • Inglês

Habilidade Técnica

  • Monitoramento de ambientes (Zabbix, Dynatrace, Grafana)
  • EKS/Docker/Kubernetes
  • Azure DevOps/ Ansible/ Chef Automate
  • Ferramentas ITSM
  • Analítico
  • Noções de redes (TCP/IP, VLAN, Firewall)
  • Cloud Logging
  • Cloud Monitoring
  • Cloud SQL
  • Compute Engine
  • ITIL Foundation
  • Fundamentos de Linux e Windows
  • Conceitos básicos de troubleshooting de rede
  • Conhecimentos básicos em containers e Kubernetes (GKE)
  • Google Cloud (Fundamentals ou Associate)
  • Noções de redes e conectividade
  • Cloud Storage
  • Gestão de incidentes (P2, P3, P4)
  • Automação de ambientes cloud
  • RCA (Root Cause Analysis)
  • Troubleshooting estruturado
  • Monitoramento e observabilidade
  • Infrastructure as Code (IaC)

Benefícios

  • Assistência médica
  • Assistência odontológica
  • Seguro de vida
  • Day Off
  • Care (Programa de apoio ao colaborador)
  • Vale Presente
  • Total Pass
  • Auxílio home-office
  • Pet love

Como chegar

Alameda Araguaia, 2104, Alphaville Industrial, Barueri - SP, Brasil, 06455-000