Hiring.Camp

Senior Site Reliability Engineer

StraitsX

·

Today

Location
Jakarta, Jakarta, Indonesia
Department
STX - Engineering
Seniority
Senior
Experience
4+ years
Source
Greenhouse

Description

About The Role

The Site Reliability Engineering (SRE) team architects, builds, and maintains the rock-solid infrastructure that applications rely on. At the Senior Level, you own reliability, performance, and cost outcomes for the systems under your area end-to-end, not just executing well-defined tasks, but deciding between tradeoffs, scoping ambiguous problems, and driving process and system improvements that span teams. You'll work closely with development, security, and product teams, and mentor other engineers as a technical point of reference for the team.

What You Will Do

  • Own the availability, performance, scalability, and security of production systems end-to-end, across cloud (AWS/GCP) and on-premises environments.
  • Design and evolve Kubernetes deployment strategy for production workloads.
  • Own CI/CD and GitOps pipelines in production (ArgoCD or equivalent) and the Terraform that provisions the infrastructure behind them.
  • Diagnose and resolve database performance issues.
  • Build and maintain observability that surfaces problems before they become incidents.
  • Seek out and implement process and system improvements affecting performance and security, coordinating with multiple stakeholders.
  • Scope and lead medium-to-large infrastructure initiatives: gather requirements, prioritize by business impact, and communicate impact to stakeholders.
  • Negotiate technical tradeoffs with stakeholders to meet business SLAs.
  • Provide technical guidance and mentorship to peers and junior engineers; promote best practices and standards across the team.
  • Maintain documentation and process discipline for the systems and incidents you own.
  • Lead structured incident investigation, isolating server, database, and application layers with a metrics-first approach, including on-call during high-traffic events.

What Are We Looking For

  • At least 4 years of experience in either SRE, DevOps, MLOps, or platform engineering, including senior-level scope at a high-traffic company.
  • Deep expertise in one major cloud provider (preferably AWS), with a proven ability to ramp up on the other quickly.Production experience & expertise with Kubernetes & Linux fundamentals
  • CI/CD & GitOps (ArgoCD or other equivalent stacks)
  • Database performance analysis & monitoring (MySQL, Postgres)
  • Observability tooling & standards (Datadog, OpenTelemetry)
  • Infrastructure as Code (Terraform)
  • Strong working English, verbal & written communication. Strong documentation and process discipline.
  • On-call & incident handling experience during high-traffic events.
  • Comfortable negotiating with stakeholders to propose technical compromises that meet business SLAs.
  • Demonstrated growth mindset and proven ability to own ambiguous scope.

Skills

AWSGCPKubernetesTerraformCI/CDLinuxMySQLDevOpsSRE

Similar Jobs

30

Senior Site Reliability Engineer

Akamai · United States, US · Remote

Today

Senior Site Reliability Engineer

Akamai · United States, US · Remote

Today

Senior Site Reliability Engineer - CloudVision

Arista Networks · Dublin, Ireland · Remote

Today

Senior Site Reliability Engineer

Walmart · IN TN CHENNAI Home Office Capita Land, India

Yesterday

Senior Site Reliability Engineer

Walmart · IN TN CHENNAI Home Office Capita Land, India

Yesterday

Senior Site Reliability Engineer - Cloud

Nvidia · US, CA, Santa Clara, United States of America

Yesterday

Senior Site Reliability Engineer - Cloud

Nvidia · Santa Clara, CA,US, US

Yesterday

Senior Site Reliability Engineer (SRE) I

Thomson Reuters · India, Bengaluru, Karnataka +1 · Hybrid

Yesterday

Senior Site Reliability Engineer - Digital Health Products

Roche · Pune DIA, India

Yesterday

[8SN] Senior Site Reliability / Production Support Engineer

Software Mind · Montreal, Canada, Canada · Remote

2 days ago

Senior Site Reliability Engineer (Kubernetes)

Mirantis · Calgary, British Columbia, Canada · Remote

3 days ago

Senior Site Reliability Engineer

Gradle Technologies · Europe (GMT) +1

3 days ago

Senior Site Reliability Engineer (SRE)

Branch · Remote, US · Remote

3 days ago

Senior Site Reliability Engineer

Gradle Technologies · North America (PST)

3 days ago

Senior Site Reliability Engineer - Remote

Akamai · Poland, PL · Remote

3 days ago

Senior Site Reliability Engineer

Rbs · Bengaluru, India

4 days ago

Senior Site Reliability Engineer, Production Engineer - ThousandEyes

Cisco · USA-SAN FRANCISCO, United States of America · Hybrid

4 days ago

Senior Site Reliability Engineer

Cisco · GBR-LONDON, United Kingdom · Hybrid

4 days ago

Senior Site Reliability Engineer (SRE)

Arrow · Ahmedabad, India +3

4 days ago

Senior Site Reliability Engineer

Cubic · Hyderabad, Telangana, India · Hybrid

4 days ago

Senior Site Reliability Engineer

Oracle · Austin, TX, United States

4 days ago

Senior Site Reliability Engineer (SRE)

Mirantis · Warsaw, Masovian Voivodeship, Poland · Remote

4 days ago

Senior Site Reliability Engineer

NielsenIQ · Pune, MH, India

5 days ago

Senior Site Reliability Engineer

Pingidentity · Bengaluru, Karnataka, India

5 days ago

Senior Site Reliability Engineer / DevOps Engineer

Sertis · Bangkok, Bangkok Metropolis, Thailand

5 days ago

Senior Site Reliability Engineer

Issgovernance · Mumbai, India

5 days ago

Senior Site Reliability Engineer

Referral Publicisgroupe · Bogota, CO

6 days ago

Senior Site Reliability Engineer - Core Cloud Platform

Lambda · San Francisco Office (Fremont St) +2 · Hybrid

6 days ago

Senior Site Reliability Engineer

Wonder · Chicago, United States of America +1

6 days ago

Senior Site Reliability Engineer

Oracle · Reston, VA, United States, US

6 days ago
Senior Site Reliability Engineer at StraitsX | Hiring.Camp