Principais atividades e responsabilidades
- Monitorar dashboards e painéis de desempenho.
- Atender, validar e classificar alertas emitidos por ferramentas como Dynatrace.
- Registrar incidentes seguindo fluxos pré-estabelecidos.
- Executar verificações básicas de saúde de serviços e aplicações.
- Realizar análise de causa raiz (RCA).
- Escalar problemas de acordo com a criticidade.
- Apoiar análises iniciais de causa, fornecendo informações consistentes ao time técnico.
- Documentar ocorrências e atualizar procedimentos quando necessários
Formação
Superior em TI, Engenharia ou áreas correlatas.
Conhecimentos técnicos obrigatórios
Monitoramento e Observabilidade
- Conhecimento básico de plataformas como Dynatrace, Zabbix, Grafana, Kibana ou semelhantes.
- Capacidade de interpretar métricas simples:
Consumo de CPU, memória e disco.
- Latência e erros de aplicação.
- Disponibilidade de hosts e serviços.
- Alertas e dashboards.
- Noções inicias de APM (Application Performance Monitoring)
- Serviços, transações, tempos de resposta.
- Dependências entre componentes.
Infraestrutura e Redes (Conhecimento Introdutório)
Protocolo HTTP/ HTTPS.
Portas e serviços.
Ping, nmap, traceroute, DNS.
- Noções gerais sobre servidores (Linux/ Windows) e serviços cloud.
Cibersegurança (para SOC júnior)
- Entendimento inicial dos conceitos:
Eventos X Incidentes.
IOC/ IOA (em nível introdutório).
Logs de segurança (firewall, antimalware, autenticação).
Ferramentas e Processos
- Utilização de ferramentas de ticket (Jira, GLPI, ServiceNow, OTRS).
- Execução de runbooks e playbooks pré-definidos.
- Capacidade de consultar e registrar logs básicos.