A Timestamp SI procura talentos que queiram fazer parte de uma equipa dinâmica que tem a ambição de desafiar a inovação e as melhores e mais recentes metodologias e tecnologias.
Responsabilidade:
Tech Lead responsável pela gestão do Centro de Controlo de Operações (CCO), assegurando a implementação de práticas de monitorização e observabilidade e garantindo que todas as aplicações, serviços e infraestruturas estão devidamente monitorizados.
- Gerir e coordenar as atividades do Centro de Controlo e Monitorização.
- Definir e implementar estratégias de monitorização e observabilidade para aplicações, serviços e infraestruturas.
- Assegurar que todas as aplicações e componentes de infraestrutura estão integrados no CCO e cobertos por mecanismos adequados de monitorização.
- Definir métricas, indicadores, dashboards e alertas operacionais, garantindo a sua relevância e eficácia.
- Promover a automação e o scripting de tarefas operacionais e processos de monitorização.
- Acompanhar eventos, incidentes e problemas, assegurando a sua análise, encaminhamento e resolução atempada.
- Garantir o cumprimento dos níveis de serviço acordados e dos processos de gestão de incidentes e eventos.
- Apoiar a definição e evolução de processos operacionais alinhados com as boas práticas ITIL.
- Trabalhar com equipas de desenvolvimento, infraestrutura e operações na identificação de riscos e melhoria contínua da fiabilidade dos serviços.
- Produzir documentação técnica e operacional, reportando indicadores de desempenho, disponibilidade e qualidade da monitorização.
Perfil Pretendido:
- Formação superior em Engenharia Informática, Engenharia de Software ou área similar.
- Capacidade para trabalhar com equipas técnicas e de negócio, traduzindo necessidades operacionais em soluções de monitorização.
- Boa capacidade de comunicação escrita e verbal.
- Experiência na liderança técnica e/ou gestão de centros de controlo, operação e monitorização.
- Experiência na implementação de soluções de monitorização e observabilidade de serviços tecnológicos.
- Conhecimentos de automação e scripting para operações de TI.
- Experiência na configuração de dashboards, métricas, indicadores e alertas operacionais.
- Conhecimentos de gestão de incidentes, eventos, problemas e níveis de serviço.
- Conhecimentos de metodologias e boas práticas ITIL.
- Experiência na análise de disponibilidade, desempenho e capacidade de aplicações e infraestruturas.
Conhecimentos valorizados:
- Experiência com ferramentas de monitorização, observabilidade, gestão de eventos e alertas.
- Conhecimentos de ambientes cloud, infraestruturas, redes, sistemas operativos e bases de dados.
- Experiência com ferramentas de automação e scripting, nomeadamente Python, PowerShell ou Bash.
- Conhecimentos de conceitos de logging, tracing, métricas, APM e monitorização de APIs.
- Experiência em ambientes de produção críticos e com requisitos elevados de disponibilidade.
- Experiência na definição e acompanhamento de SLAs, OLAs e KPIs operacionais.