Hiring.Camp

Principal Site Reliability Engineer

mtb

·

Yesterday

Salary
$140k – $233k
Location
Buffalo, NY, United States of America
Workplace
Onsite
Type
Full-time
Department
Engineering
Seniority
Lead
Education
Bachelor
Source
Workday

Description

Overview: 

Responsible for designing, implementing, and continuously improving highly reliable, scalable, and resilient platform solutions across the enterprise. Operates as a subject matter expert (SME) in Site Reliability Engineering, driving reliability engineering practices, operational excellence, and automation across the Software Development Lifecycle. Leads complex initiatives, influences enterprise engineering standards, and partners with senior stakeholders to improve system stability, observability, and performance. Serves as a mentor and technical leader for less experienced engineers across Technology. 

Primary Responsibilities: 

• Accountable for defining and driving service reliability standards, including SLOs, SLAs, and error budgets across platforms. 
• Design and implement highly available, fault-tolerant architectures aligned with enterprise scalability and resiliency requirements. 
• Lead incident management practices, including detection, response, escalation, and recovery processes. 
• Drive problem management and root cause analysis to prevent systemic issues. 
• Develop and promote observability strategies, including logging, monitoring, alerting, and tracing. 
• Lead automation initiatives for self-healing systems and operational workflows. 
• Contribute to and review technical roadmaps with reliability and performance considerations. 
• Partner with development, infrastructure, cybersecurity, and architecture teams. 
• Serve as a technical authority for performance, resilience, and capacity planning. 
• Drive production readiness practices including performance testing and failover capabilities. 
• Lead cross-team reliability improvement initiatives. 
• Participate in and lead post-incident reviews ensuring actionable outcomes. 
• Mentor engineers on reliability engineering and best practices. 
• Engage with stakeholders to identify risks and optimization opportunities. 
• Ensure adherence to risk and regulatory standards and escalate issues when needed. 
• Maintain internal control standards and compliance expectations. 

Scope of Responsibilities: 

Applies expert-level SRE practices across multiple platforms. Drives enterprise-wide reliability improvements and influences technical direction without direct authority. 

Supervisory/Managerial Responsibilities: 

No supervisory responsibilities. 

Education and Experience Required: 

Associate’s degree and a minimum of 9 years’ systems analysis and/ or application development work experience or Bachelor's degree and a minimum of 7 years' systems analysis and/ or application development work experience. In lieu of a degree, a combined minimum of 11 years’ education and/or relevant work experience, including a minimum of 7 years’ systems analysis and/ or application development work experience.  

Expert experience in system design, reliability engineering, and production operations. 
Advanced proficiency in at least one programming or scripting language. 

Education and Experience Preferred: 

Experience with observability and incident management tooling. 
Experience with cloud platforms such as AWS or Azure. 
Strong understanding of CI/CD, DevOps, and SDLC practices. 
Experience defining and implementing SLO/SLI frameworks. 
Experience in regulated environments such as financial services. 
Strong communication and stakeholder management skills. 

 

M&T Bank is committed to fair, competitive, and market-informed pay for our employees. The pay range for this position is $139,700.00 - $232,900.00 Annual (USD). The successful candidate’s particular combination of knowledge, skills, and experience will inform their specific compensation.

Location

Buffalo, New York, United States of America

Skills

AWSAzureCI/CDCybersecurityDevOpsSRECompliance

Similar Jobs

30

Principal Site Reliability Engineer

Oracle · India

Yesterday

Principal Site Reliability Engineer

Oracle · Reston, VA, United States, US

1 week ago

Principal Site Reliability Engineer

Oracle · ZAPOPAN, JALISCO, Mexico, MX

1 week ago

Principal Site Reliability Engineer

Oracle · Nashville, TN, United States, US

1 week ago

Principal Site Reliability Engineer

Sezzle · Latin America +1

1 week ago

Lead Principal Site Reliability Engineer - CSS

Oracle · Vienna, VA, United States, US

2 weeks ago

Principal Site Reliability Engineer - Exadata Cloud Service

Oracle · United States, US

2 weeks ago

Principal Site Reliability Engineer

Oracle · ZAPOPAN, JALISCO, Mexico, MX

2 weeks ago

Principal Site Reliability Engineer

Oracle · Nashville, TN, United States, US

2 weeks ago

Principal Site Reliability Engineer

Oracle · Nashville, TN, United States, US

2 weeks ago

Lead Principal Site Reliability Engineer

Oracle · Nashville, TN, United States, US

2 weeks ago

Principal Site Reliability Engineer

Oracle · Nashville, TN, United States, US

2 weeks ago

Principal Site Reliability Engineer - ARINCDirect (Remote)

RTX · US-VA-REMOTE, United States of America · Remote

3 weeks ago

Principal Site Reliability Engineer

Disney · USA - FL - Kirkman Point 2, United States of America +1 · Onsite

1 month ago

Principal Site Reliability Engineer

Disney · USA - FL - Kirkman Point 2, United States of America +1 · Onsite

1 month ago

Principal Site Reliability Engineer

Oracle · United States, US

1 month ago

Principal Site Reliability Engineer - Austin, Texas

ShipperHQ · Austin, TX

1 month ago

Principal Site Reliability Engineer, Google Cloud

Saviynt · Atlanta +1 · Hybrid

1 month ago

Principal Site Reliability Engineer

Fmr · 300 New Millennium Way, Durham NC, United States of America

1 month ago

Principal Site Reliability Engineer

Waters · Brasov, RO

1 month ago

Consulting/Principal Site Reliability Engineer

Relx · India-Mumbai (Kalpataru Square)

1 month ago

Consulting/Principal Site Reliability Engineer

RELX Jobs · India-Mumbai (Kalpataru Square)

1 month ago

Principal Site Reliability Engineer

Accela · Remote Based - US · Remote

1 month ago

Principal Site Reliability Engineer

Saviynt · Vancouver · Hybrid

1 month ago

Principal Site Reliability Developer

Oracle · NOIDA, UTTAR PRADESH, India

2 months ago

Principal Site Reliability Engineer - Observability and Telemetry Platform

Nvidia · US, CA, Santa Clara, United States of America +1 · Remote

2 months ago

Principal Site Reliability Engineer

Roche · Basel Headquarter, Switzerland

2 months ago

Principal Site Reliability Engineer

SimCorp is · Hyderabad, India

2 months ago

Principal Site Reliability Engineer - Observability and Telemetry Platform

Nvidia · Santa Clara, CA,US, US +1 · Remote

2 months ago

Principal Site Reliability Engineer

earlywarningservices · Scottsdale, United States of America +2 · Hybrid

3 months ago
Principal Site Reliability Engineer at mtb • $140k – $233k | Hiring.Camp