Descrição
Talkdesk está procurando um Senior Site Reliability Engineer para se juntar à nossa equipa de Porto Engineering. Nesta função, você será responsável por desenhar, construir e manter componentes-chave da nossa infraestrutura de plataforma interna, trabalhando com tecnologias de ponta como Kubernetes, Prometheus e ferramentas GitOps. Você irá automatizar práticas de implementação segura, provisionar infraestrutura e contribuir para a excelência operacional da nossa plataforma.
Você trabalhará em sistemas complexos em larga escala, aplicando uma mentalidade de desenvolvedor à infraestrutura. A posição oferece a oportunidade de resolver problemas técnicos desafiadores, coachear outros membros da equipa e ter um impacto imediato no trabalho que realiza. Este é um papel híbrido baseado em Porto, Portugal, onde você será parte de uma cultura inclusiva e diversa que valoriza a inovação e o empoderamento.
Competências
- Kubernetes
- Linux/Unix
- Terraform
- Ansible
- Java
- Kotlin
- Scala
- Python
- Ruby
- Bash
- PostgreSQL
- MySQL
- MongoDB
- Redis
- Elasticsearch
- GitHub Actions
- ArgoCD
- Argo Rollouts
- Helm Charts
- Spacelift
- Atlantis
- Infrastructure as Code
- GitOps
Responsabilidades
- Desenhar, construir, fortalecer e manter partes-chave da infraestrutura da plataforma (desde o ciclo de vida da infraestrutura até cada cluster Kubernetes)
- Suportar processos que permitem a atualização segura de cada componente da infraestrutura de computação
- Trabalhar com ferramentas GitOps líderes da indústria como Spacelift e/ou Atlantis
- Ajudar a automatizar práticas de implementação segura usando ferramentas líderes como GitHub Actions, ArgoCD, Argo Rollouts, Helm Charts
- Ajudar a automatizar o provisionamento de infraestrutura e outros processos de engenharia
- Coachear e desenvolver as competências de outros membros da equipa de engenharia
- Resolver problemas técnicos desafiadores e testar as suas competências diariamente
- Automatizar todos os aspetos da infraestrutura para remover intervenção humana
- Desenvolver ferramentas eficazes, alertas e respostas para identificar e resolver riscos de confiabilidade
- Impulsionar e promover protocolos de preparação para produção e excelência operacional
- Colaborar com equipas de engenharia de produto para depurar falhas de produção
- Defender testes automatizados, integração contínua e entrega, feature toggles e rollouts progressivos
- Planear o crescimento da infraestrutura da Talkdesk
Empregos semelhantes
