Blip

Site Reliability Engineer

BlipPorto

Descrição

Junte-se à Blip, uma empresa de tecnologia líder focada em soluções de engenharia de software para entretenimento desportivo e parte do Flutter Entertainment. Como Site Reliability Engineer, será responsável por monitorizar de perto a disponibilidade, desempenho e estabilidade das nossas plataformas, trabalhando em estreita colaboração com equipas de desenvolvimento de software para melhorar componentes críticos. Enfrentará desafios complexos enquanto garante uptime e fiabilidade em diferentes configurações (AWS Cloud, AWS Outpost, OpenStack), utilizando competências diversas em programação, algoritmos e análise de complexidade.

O seu dia a dia incluirá participação ativa em todo o ciclo de vida dos serviços—desde design, implementação e operação até refinamento contínuo. Será responsável por investigar problemas de produção, identificar causas raiz e resolvê-las. Apoiará serviços antes do lançamento através de design de sistemas, desenvolvimento de plataformas de software, planeamento de capacidade e revisões de lançamento, e manterá serviços em produção medindo e monitorizando disponibilidade, latência e saúde geral do sistema.

Valorizamos pessoas criativas, colaborativas e orientadas para resolver problemas. Procuramos alguém com conhecimento profundo em Sistemas Operativos e Networking, experiência em linguagens de programação como Python, Java ou Go, familiaridade com fornecedores de cloud públicos, arquiteturas de microserviços, serviços de message queuing, ferramentas de Configuration Management (Chef, Ansible), soluções de monitorização (Datadog, Splunk) e pipelines CI/CD (Jenkins, Git, Artifactory).

Competências

  • Sistemas Operativos
  • Networking
  • Python
  • Java
  • Go
  • AWS Cloud
  • AWS Outpost
  • OpenStack
  • Arquiteturas de Microserviços
  • Message Queuing
  • Chef
  • Ansible
  • Datadog
  • Splunk
  • Jenkins
  • Git
  • Artifactory
  • Grafana
  • Monitorização de Sistemas
  • Incident Response
  • CI/CD Pipelines

Responsabilidades

  • Monitorizar de perto a disponibilidade das plataformas, desempenho e estabilidade
  • Trabalhar em estreita colaboração com equipas de desenvolvimento de software para melhorar componentes críticos
  • Participar em todo o ciclo de vida dos serviços—desde design, implementação, operação e refinamento
  • Realizar investigação ativa de problemas de produção, identificação e resolução de causas raiz
  • Apoiar serviços antes do lançamento através de design de sistemas, desenvolvimento de plataformas e frameworks, planeamento de capacidade e revisões de lançamento
  • Manter serviços em produção medindo e monitorizando disponibilidade, latência e saúde geral do sistema
  • Participar ativamente em testes de desempenho e capacidade
  • Otimizar monitorização e alertas de fiabilidade
  • Escalar sistemas de forma sustentável através de mecanismos de automação
  • Realizar auditorias iterativas de vulnerabilidades de desempenho e fiabilidade
  • Definir e revisar Service Level Indicators (SLIs)
  • Praticar resposta a incidentes sustentável e postmortems sem culpabilização
  • Utilizar Grafana como solução de monitorização

Benefícios

  • Perks e benefícios competitivos (consultar website da empresa para detalhes completos)

Conhece alguém para esta vaga?

Empregos semelhantes

Blip
Blip
Tecnologia
Ver perfil da empresa
Site Reliability EngineerBlip
Candidatar-me