Analista de Monitoração e Automação de Redes

Analista de Monitoração e Automação de Redes

Analista de Monitoração e Automação de Redes

Net Turbo Telecom

Gupy

Campinas São Paulo Brasil

3 horas atrás

Nenhuma candidatura

Sobre

Atuar como o arquiteto do ecossistema de telemetria e resposta a incidentes. Sua missão é construir a inteligência por trás do NOC. Ele é o responsável por desenhar a arquitetura do Zabbix/Grafana, realizar a correlação de eventos complexos (eliminando falsos positivos) e desenvolver automações (via scripts e APIs) que integrem os alarmes da rede diretamente ao sistema de chamados (ITSM) e aos canais de comunicação (WhatsApp/Telegram), garantindo que a equipe operacional trabalhe apenas com incidentes reais e acionáveis. Responsabilidades e atribuições Engenharia de Monitoração: Desenvolver e customizar templates no Zabbix utilizando LLD (Low-Level Discovery), macros de usuário, scripts externos e expressões regulares para monitorar OLTs, roteadores de borda BGP e switches de agregação de múltiplos fabricantes (Huawei, Cisco, Datacom, etc.).Correlação de Eventos (Inteligência de Alarmes): Aplicar a prática ITIL de Gestão de Eventos criando dependências lógicas de Triggers. (Exemplo: Se um POP perde energia e a OLT cai, o sistema deve suprimir os alarmes individuais de várias ONUs e gerar apenas um Alarme Crítico de Causa Raiz).Integração ITSM e NMS: Desenvolver e manter a integração via API (REST/JSON) entre o sistema de monitoramento e o sistema de chamados. Garantir a abertura automática de tickets enriquecidos com logs e o fechamento automático (auto-resolve) quando a falha for normalizada.Automação de Escalonamento (Notificações): Programar Webhooks e integrações com APIs de mensageria para disparar alertas críticos, boletins de massiva e relatórios de turnos diretamente em grupos de WhatsApp corporativos ou Telegram, segmentados por nível de severidade e equipe de plantão.Tuning e Erradicação de Falsos Positivos: Auditar semanalmente a base de alarmes não reconhecidos, calibrando os gatilhos (Thresholds) de CPU, memória, latência e saturação de link, garantindo que o NOC Júnior não sofra de "cegueira de alarmes".Dashboards Executivos e Capacity Planning: Construir painéis dinâmicos no Grafana cruzando dados técnicos e de negócio para a Diretoria, focados em Uptime (MTBF), uso de capacidade de PTTs/Trânsitos e projeções de esgotamento de portas. Requisitos e qualificações ·         Ensino Superior completo – cursos de preferência: Telecomunicações, Rede de Computadores, Ciência da Computação e áreas afins. Conhecimento técnico em:Especialista em Zabbix e Grafana: Experiência comprovada na administração de Zabbix em ambientes de grande porte (Proxies, tuning de banco de dados, arquitetura distribuída). Certificação ZCP (Zabbix Certified Professional) será um grande diferencial.Programação e Automação (Scripting): Domínio em Python e/ou Bash/Shell Script. Conhecimento sólido no consumo e criação de APIs RESTful, manipulação de JSON (N8N) e Webhooks.Redes e Telecomunicações: Conhecimento profundo dos protocolos SNMP (v2c e v3), Syslog, NetFlow/sFlow. Entendimento sólido da arquitetura de Provedores de Internet (BGP, OSPF, MPLS, GPON).Processos ITIL: Domínio prático do ciclo de vida de Incidentes e Gestão de Eventos. Informações adicionaisEscala 5x2 Formato: Híbrido