Similar Jobs
See allTechnology Analyst - Operations
Turnitin
UK
Site Reliability Engineering
Operational Analytics
Data Visualization
SRE and DevOps Team Manager
Eltropy
India
Kubernetes
AWS
Terraform
Principal Site Reliability Engineer
Experian
Brazil
Kubernetes
AWS
Terraform
Senior Support Engineer (Leadership)
Jobgether
Brazil
TypeScript
JavaScript
SQL
Staff Site Reliability Engineer
Filevine
Kubernetes
Python
Go
Role and Responsibilities:
- Lead and coordinate teams handling system incidents and N1, N2, N3 technical support for effective resolution and service continuity.
- Manage problem management, root cause analysis, and drive corrective/preventive actions.
- Oversee SRE, reliability, monitoring, and observability to enhance system stability.
Team and Budget Management:
- Manage capacity, availability, and business continuity, anticipating operational risks.
- Oversee team budget, monitor resources and expenses aligned with priorities.
- Coordinate technology suppliers and service providers, monitoring performance and adherence.
Continuous Improvement:
- Support continuous improvement in systems operations, identifying efficiency and reliability opportunities.
- Apply advanced knowledge of SQL, Python, cloud services, and data architecture for informed decision-making.
- Leverage ITIL principles and service management practices to improve operations.
Jobgether
Jobgether is an AI-powered job matching platform that connects candidates with hiring companies. It operates remotely and focuses on using technology to streamline recruitment processes.