- Presencial
- Tempo inteiro
- Sénior
Descrição
Como Senior DevOps Engineer na Blip, você irá projetar, construir e aprimorar o ecossistema de observabilidade que sustenta nossa plataforma e serviços. Seu foco será fornecer visibilidade profunda do comportamento do sistema, combinando telemetria de sistema com sinais do usuário para oferecer uma visão holística de desempenho, confiabilidade e experiência. Você também explorará como IA e machine learning podem aprimorar a observabilidade, desde alertas inteligentes e detecção de anomalias até acelerar análise de causa raiz.
Este é um papel prático onde você trabalhará em parceria com times de engenharia e produto para entregar capacidades de observabilidade escaláveis, servindo como especialista no assunto em monitoramento, alertas e gerenciamento de incidentes. Você equipará os times com insights e ferramentas de autoatendimento, conectando comportamento do sistema ao impacto real do usuário e aproveitando workflows assistidos por IA para identificar problemas mais rapidamente, impulsionando melhorias em confiabilidade, desempenho e tomada de decisão baseada em dados em toda a organização.
Você contribuirá na definição e impulsão da estratégia e roadmap de observabilidade entre múltiplos times, alinhando-se com prioridades de negócio e objetivos de engenharia. Liderará iniciativas de múltiplos times para melhorar confiabilidade de ponta a ponta, identificando riscos sistêmicos e impulsionando sua resolução, enquanto mentoriza engenheiros e eleva a maturidade de confiabilidade e observabilidade em toda a organização.
Competências
- Observabilidade
- Engenharia de SRE
- Datadog
- Kubernetes
- AWS
- Terraform
- Infrastructure as Code
- Monitoramento
- Alertas
- Gerenciamento de Incidentes
- Go
- Java
- Python
- TypeScript
- Helm
- Ansible
- Vault
- PagerDuty
- SLO
- SLI
- Sistemas Distribuídos
- Automação
- Machine Learning
Responsabilidades
- Contribuir na definição e impulsão da estratégia e roadmap de observabilidade entre múltiplos times, alinhando com prioridades de negócio e objetivos de engenharia
- Projetar e melhorar capacidades de observabilidade escaláveis que forneçam insights acionáveis sobre saúde do sistema, desempenho e experiência do usuário
- Estabelecer e padronizar melhores práticas para monitoramento, alertas, gerenciamento de incidentes e postmortems em toda a organização
- Impulsionar excelência operacional evoluindo o gerenciamento de incidentes, práticas de on-call e aprendizado pós-incidente, garantindo melhorias sistêmicas
- Liderar iniciativas cross-team para melhorar confiabilidade de ponta a ponta, identificando riscos sistêmicos e impulsionando sua resolução
- Aproveitar automação e workflows assistidos por IA para acelerar análise de causa raiz e reduzir toil operacional em escala
- Fazer parceria com liderança de engenharia e produto para traduzir insights de observabilidade em decisões estratégicas de roadmap
- Identificar tendências entre sinais de sistema e usuário para detectar, prevenir e mitigar proativamente problemas em larga escala
- Otimizar plataformas de observabilidade para custo, escalabilidade e sustentabilidade de longo prazo
- Mentorizar engenheiros e elevar a maturidade de confiabilidade e observabilidade em toda a organização
Benefícios
- Perks e benefícios disponíveis no site da Blip
Conhece alguém para esta vaga?