- Location
- Sao Paulo, Torre Paineira, Brazil · Rio de Janeiro, Rio Metropolitan Center · Nova Lima, Shopping Alta Vila · Pernambuco - Recife
- Workplace
- Hybrid
- Type
- Full-time
- Department
- IT
- Source
- Workday
Description
Como Analista DevOps Sênior, você terá um papel fundamental na construção e evolução de ambientes altamente resilientes, escaláveis e observáveis. Atuando com práticas avançadas de Site Reliability Engineering (SRE), automação e Cloud Computing, você será responsável por impulsionar a confiabilidade das plataformas, otimizar processos operacionais e garantir a excelência na entrega de soluções digitais.
Esta posição é estratégica para apoiar iniciativas de transformação digital, promovendo automação, estabilidade operacional e melhoria contínua em ambientes de missão crítica.
Faça parte de uma equipe que combina inovação, engenharia de excelência e colaboração para construir soluções modernas em escala global. Aqui, você terá a oportunidade de trabalhar com tecnologias de ponta, participar de projetos desafiadores e contribuir diretamente para a evolução das melhores práticas de confiabilidade, automação e operação em cloud.
Together we do what matters.
Saiba mais sobre alguns dos nossos benefícios:
- Vale refeição ou alimentação
- Cartão Multibenefícios (até Consultor(a) Sênior)
- Convênio médico e odontológico
- Certificações e treinamentos
- Seguro de vida
- Previdência privada
- Avababy: acompanhamento da gestação e kit para novos pais e mães
- Participação nos resultados da empresa
- Wellhub
- Auxílio creche
- Mentoria de carreira
- Política de Birthday Off (um dia de folga no mês do seu aniversário)
- Sessões de bem-estar
- Para cargos gerenciais: veículo corporativo, estacionamento e auxílio combustível
Responsabilidades
- Implementar e evoluir práticas de Site Reliability Engineering (SRE);
- Administrar e otimizar ambientes Linux/Unix de alta criticidade;
- Criar, manter e aprimorar pipelines de CI/CD;
- Gerenciar ambientes conteinerizados utilizando Docker e Kubernetes;
- Desenvolver e manter infraestrutura como código (IaC) utilizando Terraform, Pulumi ou ferramentas similares;
- Implementar soluções de observabilidade utilizando métricas, logs e tracing;
- Definir e acompanhar indicadores de confiabilidade como SLI, SLO e SLA;
- Atuar na gestão e resposta a incidentes críticos;
- Realizar troubleshooting avançado em ambientes distribuídos;
- Garantir práticas de segurança relacionadas a IAM, TLS, gerenciamento de segredos e acesso;
- Gerenciar plataformas de monitoramento e observabilidade como Prometheus, Grafana e Alertmanager;
- Implementar estratégias para redução de falhas, eliminação de atividades repetitivas (toil) e aumento da automação;
- Conduzir análises de causa raiz (RCA), postmortems e iniciativas de melhoria contínua;
- Colaborar com times de desenvolvimento, arquitetura e operações para promover excelência operacional.
.
Habilidades e experiências
Requisitos obrigatórios
- Experiência sólida atuando como DevOps Engineer, SRE ou posições similares;
- Forte domínio de Git e GitHub (branching, pull requests e estratégias de versionamento);
- Experiência avançada com Linux e Unix;
- Conhecimento profundo em troubleshooting de aplicações e infraestrutura;
- Experiência com Docker, incluindo build, otimização e segurança de imagens;
- Experiência com Kubernetes para deploy, operação e diagnósticos;
- Conhecimento em observabilidade (métricas, logs e tracing);
- Experiência com Prometheus, Grafana e Alertmanager;
- Vivência na definição e gestão de SLI, SLO e SLA;
- Experiência com Infrastructure as Code utilizando Terraform, Pulumi ou similares;
- Experiência em ambientes Cloud (Azure, AWS ou OCI);
- Conhecimento em automação através de scripts;
- Experiência com pipelines CI/CD;
- Conhecimentos sólidos de redes e protocolos;
- Experiência com segurança de infraestrutura, IAM, TLS e gestão de segredos;
- Conhecimento em plataformas de logging como ELK Stack ou Loki;
- Experiência com gestão de incidentes, confiabilidade e melhoria contínua;
- Perfil analítico, colaborativo e orientado à resolução de problemas;
Diferenciais
- Experiência com Service Mesh;
- Conhecimento em arquiteturas resilientes e distribuídas;
- Experiência com testes de performance e carga;
- Vivência em ambientes multi-cloud;
- Conhecimento em FinOps e otimização de custos em cloud;
- Experiência com Apache Kafka;
- Conhecimento em estratégias avançadas de deploy;
- Experiência como referência técnica ou liderança técnica de times;
- Certificações em Cloud, Kubernetes ou DevOps.
.