Job Summary
| Skill / Category | Mandatory / Non-Mandatory | Evaluation Focus | Rationale |
| Site Reliability Engineering (SRE) & Operational Excellence | Mandatory | Dynatrace Observability Platform Administration Observability Engineering (Metrics, Logs, Traces & Events) OpenTelemetry Data Integration & Telemetry Management SLI/SLO Frameworks & Reliability Engineering Alert Engineering & Incident Prevention Cloud-Native SRE & Operational Excellence Incident Management & Problem Management Practices Observability Automation & Self-Service Platform Engineering Operational Resilience & Service Health Governance |
Core technology ownership for the role. |
| Kubernetes (GKE) Observability & Platform Monitoring | Mandatory | Monitoring containerized workloads, cluster health, performance analysis and troubleshooting | Essential for cloud-native platform operations. |
| Istio Service Mesh Monitoring & Service Dependency Visibility | Mandatory | Service communication monitoring, dependency mapping, traffic observability and operational insights | Required to understand complex service interactions. |
| Kafka Monitoring & Event Platform Observability | Mandatory | Monitoring brokers, partitions, topics, consumer lag, throughput, failures and resilience indicators | Critical for supporting event-driven banking services. |
| Cross-Team Service Journey Monitoring & Integration Visibility | Mandatory | End-to-end monitoring across upstream and downstream dependencies and business-critical journeys | Supports holistic operational visibility across the ecosystem. |
| TM Vault Observability & Platform Operations | Preferred | Experience monitoring Vault services, dependencies and operational health indicators | Directly relevant to the target platform. |
| Distributed Systems Observability & Performance Engineering | Preferred | Monitoring large-scale distributed systems, dependency mapping and performance optimization | Valuable for complex cloud-native environments. |
| FinOps, Cloud (GCP) Cost Management | Preferred | FinOps, Cloud Cost Observability & Cost-to-Service Mapping GCP Cost Management & Cloud Consumption Analytics |
Supports operational and financial efficiency objectives. Valuable for FinOps maturity and platform optimization. |
| Training, Enablement & Knowledge Transfer | Preferred | Development of training content, coaching and observability adoption across engineering teams | Supports long-term organizational capability building. |
Key Responsibilities
| Skill / Category | Mandatory / Non-Mandatory | Evaluation Focus | Rationale |
| Site Reliability Engineering (SRE) & Operational Excellence | Mandatory | Dynatrace Observability Platform Administration Observability Engineering (Metrics, Logs, Traces & Events) OpenTelemetry Data Integration & Telemetry Management SLI/SLO Frameworks & Reliability Engineering Alert Engineering & Incident Prevention Cloud-Native SRE & Operational Excellence Incident Management & Problem Management Practices Observability Automation & Self-Service Platform Engineering Operational Resilience & Service Health Governance |
Core technology ownership for the role. |
| Kubernetes (GKE) Observability & Platform Monitoring | Mandatory | Monitoring containerized workloads, cluster health, performance analysis and troubleshooting | Essential for cloud-native platform operations. |
| Istio Service Mesh Monitoring & Service Dependency Visibility | Mandatory | Service communication monitoring, dependency mapping, traffic observability and operational insights | Required to understand complex service interactions. |
| Kafka Monitoring & Event Platform Observability | Mandatory | Monitoring brokers, partitions, topics, consumer lag, throughput, failures and resilience indicators | Critical for supporting event-driven banking services. |
| Cross-Team Service Journey Monitoring & Integration Visibility | Mandatory | End-to-end monitoring across upstream and downstream dependencies and business-critical journeys | Supports holistic operational visibility across the ecosystem. |
| TM Vault Observability & Platform Operations | Preferred | Experience monitoring Vault services, dependencies and operational health indicators | Directly relevant to the target platform. |
| Distributed Systems Observability & Performance Engineering | Preferred | Monitoring large-scale distributed systems, dependency mapping and performance optimization | Valuable for complex cloud-native environments. |
| FinOps, Cloud (GCP) Cost Management | Preferred | FinOps, Cloud Cost Observability & Cost-to-Service Mapping GCP Cost Management & Cloud Consumption Analytics |
Supports operational and financial efficiency objectives. Valuable for FinOps maturity and platform optimization. |
| Training, Enablement & Knowledge Transfer | Preferred | Development of training content, coaching and observability adoption across engineering teams | Supports long-term organizational capability building. |