Hiring.Camp

SRE (Site Reliability Engineer)

Babelgroup

·

Yesterday

Location
CIUDAD DE GUATEMALA · SAN SALVADOR
Workplace
Remote
Type
Full-time
Department
Engineering
Source
Workday

Description

We are One Team. We make it happen. We are Unstoppable.

Babel, enriching people through technology

BABEL es una consultora tecnológica multinacional especializada en aplicar sus servicios y conocimiento tecnológico en los procesos de aceleración digital de sus clientes, grandes empresas y organismos públicos.

¿Cuál es nuestro plan estratégico?

¡Miramos hacia el futuro! Nuestro plan estratégico Hiperespacio 2029 promete ser un viaje emocionante, lleno de oportunidades para crecer y desarrollarse profesionalmente. Alcanzar 1000 millones de facturación, un reto que estamos seguros de que con la colaboración y el talento de nuestra gente, será otra historia de éxito que escribiremos juntos y juntas.

¿Qué buscamos?

Objetivo del Rol

Liderar la estrategia de Site Reliability Engineering (SRE) para las aplicaciones de Centroamérica, garantizando altos niveles de disponibilidad, confiabilidad, rendimiento y eficiencia operativa, con especial enfoque en las aplicaciones NextGen desplegadas en WCNP.

Este rol impulsará la adopción de prácticas DevOps, SRE y FinOps, promoviendo la automatización, la observabilidad, la gestión proactiva de incidentes y la optimización de costos en la nube, asegurando plataformas estables, escalables y alineadas con los objetivos del negocio.

Oportunidad disponible para personas de El Salvador y Guatemala.

Responsabilidades

  • Definir, implementar y monitorear SLOs, SLIs y Error Budgets para servicios críticos.

  • Diseñar y mantener la estrategia de observabilidad mediante métricas, logs, dashboards y alertas.

  • Monitorear la disponibilidad, rendimiento y estabilidad de las aplicaciones desplegadas en WCNP.

  • Liderar iniciativas de FinOps para optimizar el consumo y costos de la nube.

  • Apoyar la migración, incorporación y estabilización de aplicaciones en entornos Kubernetes.

  • Garantizar la confiabilidad de los despliegues mediante pipelines de CI/CD y procesos automatizados.

  • Automatizar tareas operativas utilizando Python, Bash, Ansible u otras herramientas para reducir el trabajo manual (toil).

  • Liderar la atención de incidentes críticos, realizar análisis de causa raíz (RCA) y asegurar la implementación de acciones correctivas y preventivas.

  • Definir y dar seguimiento a indicadores como MTTR, disponibilidad, métricas DORA y recurrencia de incidentes.

  • Promover buenas prácticas de SRE, DevOps y Observabilidad, brindando acompañamiento técnico al equipo.

Tech Stack

Indispensable

  • Kubernetes y tecnologías de contenedores.

  • WCNP o plataformas basadas en Kubernetes.

  • Grafana, Prometheus y herramientas de observabilidad.

  • Herramientas de gestión y análisis de logs.

  • Python y/o Bash.

  • Concord, Looper o herramientas equivalentes de CI/CD.

  • Azure y/o Google Cloud Platform (GCP).

  • Git.

  • SLOs, SLIs, Error Budgets, gestión de incidentes y RCA.

  • Herramientas de IA aplicadas a operaciones, análisis de logs y automatización.

Deseable

  • Terraform.

  • Ansible.

  • OpenTelemetry.

  • Herramientas de FinOps.

  • Plataformas de trazabilidad distribuida.

  • Métricas DORA.

  • Chaos Engineering y pruebas de resiliencia.

Requisitos

  • Bachillerato universitario en Ingeniería en Sistemas, Computación o carreras afines.

  • Inglés fluido (B2+/C1), con capacidad para participar en reuniones técnicas, colaborar con equipos globales y comprender documentación especializada.

  • 5 años o más de experiencia en infraestructura, operaciones, DevOps, Cloud o confiabilidad de aplicaciones.

  • 3 años o más de experiencia en roles de Site Reliability Engineering (SRE), DevOps, Platform Engineering o Cloud Engineering.

  • Experiencia comprobada con Kubernetes y tecnologías de contenedores.

  • Experiencia implementando soluciones de observabilidad, monitoreo y alertamiento.

  • Experiencia con automatización y gestión de pipelines CI/CD.

  • Experiencia en gestión de incidentes críticos, análisis de causa raíz (RCA) y mejora continua.

  • Deseable experiencia en iniciativas de FinOps y optimización de costos en la nube.

#babel

¿Qué ofrecemos?

Babel, the great way to achieve the success.

¿Quieres formar parte de un equipo en expansión, comprometido e innovador que hace historia cada día?  En Babel te acompañamos en tu camino hacia el éxito. Creemos en el talento de las personas y lo queremos potenciar.

Trabajar en Babel es mucho más que trabajar en una empresa, es unirse a un equipo de personas con una misión compartida y a un modelo de compañía centrado en valores.

Y lo hacemos promoviendo la diversidad, la equidad y la inclusión, garantizando la igualdad de oportunidades a todas las personas candidatas, en un entorno libre de cualquier tipo de discriminación.

Además,

Foco en trabajar con últimas tecnologías y proyectos innovadores, pero sobre todo, acompañamos a la transformación digital y acercamos la tecnología a la sociedad.

Comunicación y transparencia: Siempre estarás informado de las últimas noticias de la compañía.

• Contribuimos a la formación constante de nuestros Babelievers.

• Programa de promociones profesionales y desarrollo de talento.

• Trabajo con proyectos de diversos países lo que nos permite aprender de diferentes culturas. 

• Contribuimos en tu salud física y emocional (Charlas, competencias deportivas). 

• Participamos del crecimiento de la compañía, reconocemos la participación de cada persona con nuestro bono solidario.

• Apostamos por la flexibilidad laboral – personal. 

• Bono por referidos.

• Convenios comerciales según sede.

¿Aceptas el desafío? ¡Te esperamos!

En cumplimiento de la normativa vigente en materia de protección de datos te informamos que el responsable de tus datos personales es GRUPO BABEL (consultar empresas en la política de privacidad), y los utilizará para gestionar tus procesos de selección, tanto actuales como futuros y el resto de finalidades descritas en la web. Este tratamiento está basado en el consentimiento del candidato. Los datos personales recabados no serán en ningún caso cedidos a terceros salvo por obligaciones legales expresas. Puedes ejercer los derechos que te asisten sobre protección de datos en la dirección [email protected]. Toda la información sobre política de privacidad en nuestra web.

Skills

PythonAzureGCPKubernetesTerraformAnsibleCI/CDGitDevOpsSRE

Similar Jobs

30

SRE (Site Reliability Engineer)

Globe · NCR - WGC, Philippines

Yesterday

SRE (Site Reliability Engineer)

Globe · NCR - WGC, Philippines

1 month ago

SRE (Site Reliability Engineer)

Internet Vikings · Tas-Sliema, Sliema, Malta

2 months ago

SRE (Site Reliability Engineer)

Globe · NCR - WGC, Philippines

3 months ago

Staff Software Engineer, Site Reliability (SRE)

Harvey · Bengaluru · Hybrid

4 months ago

SRE (Site Reliability Engineer) - H/F

Devoteam · Levallois-Perret, IDF, France · Hybrid

6 months ago

SRE (Site Reliability Engineer)

Globe · NCR - WGC, Philippines

7 months ago

Software Engineer, Site Reliability (SRE)

Sierra · San Francisco, CA

9 months ago

SRE | Site Reliability Engineering

C6Bank · São Paulo, Brazil

1+ year ago

SRE (Site Reliability Engineer)

Tailor · Tokyo · Remote

1+ year ago

SRE (Site Reliability Engineer) [業務委託]

Tailor · Tokyo · Remote

1+ year ago

SRE (Site Reliability Engineer)

Route06 · リモート勤務

1+ year ago

Senior DevOps/Site Reliability Engineer (SRE)

Elliginthealth · Edison, NJ +1

Today

Head of Site Reliability Engineering (SRE)

Blockchain · London +1 · Remote, Hybrid

Today

[8SN] Site Reliability Engineer (SRE) – UI/UX

Software Mind · Montreal, Canada, Canada · Remote

Yesterday

Site Reliability Engineer (SRE), Specialised in Postmortem practices

Ing · HBP (Amsterdam - Haarlerbergpark), Netherlands

2 days ago

Senior Site Reliability Engineer [SRE Infrastructure]

Draftkings · Remote - Bulgaria +1 · Remote

2 days ago

Sr. Site Reliability Engineer - SRE

" QAD, Inc." · Barcelona, CT, Spain · Remote

2 days ago

Senior Site Reliability Engineer (SRE) I

Thomson Reuters · India, Bengaluru, Karnataka +1 · Hybrid

3 days ago

Senior Site Reliability Engineer (SRE)

Branch · Remote, US · Remote

5 days ago

Site Reliability Engineer (SRE), Cloud Operations

Rbc · RBC CENTRE, 155 WELLINGTON ST W:TORONTO, Canada

6 days ago

Senior Site Reliability Engineer (SRE)

Arrow · Ahmedabad, India +3

6 days ago

DevOps / Site Reliability Engineer (SRE)

Inetum · Lisbon, Lisbon, Portugal · Hybrid

6 days ago

Senior Site Reliability Engineer (SRE)

Mirantis · Warsaw, Masovian Voivodeship, Poland · Remote

6 days ago

Senior App/Prod Support (Tier 3 Site Reliability Engineer (SRE) / Platform Engineer)

Att · IND:AP:Hyderabad / Argus Bldg 4f & 5f, Sattva, Knowledge City- Adm: Argus Building, Sattva, Knowledge City, India +1 · Remote

1 week ago

Site Reliability Engineer (SRE) - DevOps

Encora · Brazil

1 week ago

Site Reliability Engineering (SRE) Leader

Patsnap · Remote, UK · Remote

1 week ago

Lead Site Reliability Engineer (SRE) - Martech

Nab · 15 Tran Bach Dang An Khanh Ward, Vietnam

1 week ago

Site Reliability Engineer (SRE/ DevOps) - Engineering Productivity

Arista Networks · Dublin, County Dublin, Ireland · Remote

1 week ago

Site Reliability Engineer (SRE) / Service Availability Manager

Marriott Hotels & Resorts · Bethesda, MD, United States, US

2 weeks ago