SRE-Leiter

Full Time
Ort Edinburgh, Midlothian
Veroeffentlicht Apr 02, 2026

Job-Highlights

Full Time

Beschäftigungsart

Edinburgh, Midlothian

Ort

5 Monate

Veroeffentlicht

Internationale Bewerber willkommen

Potenzielle Möglichkeit einer Arbeitserlaubnis

Diese Stelle steht möglicherweise internationalen Bewerbern mit entsprechenden Qualifikationen offen. Wenden Sie sich für Einzelheiten zum Visumssponsoring an den Arbeitgeber.

Warum Imployii für internationale Arbeitssuchende:
  • Direkter Zugang zu Arbeitgebern mit Visa-Sponsoring-Geschichte
  • Kompetente Visa- und Umzugsberatung
  • Prioritätsabgleich für grenzüberschreitende Möglichkeiten
Edinburgh, …

Stellenbeschreibung

SRE-Leiter Unser Kunde, ein führender globaler Anbieter von IT-Dienstleistungen, benötigt einen erfahrenen SRE-Leiter, der im Büro seines Kunden in Edinburgh, Großbritannien, ansässig ist. Dies ist eine Hybridrolle – Sie können remote in Großbritannien arbeiten und das Büro in Edinburgh an zwei Tagen pro Woche besuchen. Es handelt sich um einen 6-monatigen befristeten Vertrag (Verlängerung möglich), der so schnell wie möglich beginnt. Tagessatz: Wettbewerbsfähiger Marktpreis. Rollenbeschreibung: Der Kunde sucht einen erfahrenen Site Reliability Engineer (SRE) zur Verstärkung Das Team der Everyday Banking Platform. In dieser Rolle sind Sie dafür verantwortlich, die Zuverlässigkeit, Skalierbarkeit und Leistung ihrer Cloud-Infrastruktur und Anwendungen auf GCP sicherzustellen. Ihr Schwerpunkt liegt auf der Automatisierung von Infrastrukturbereitstellungen, der Optimierung von CI/CD-Pipelines, der Überwachung des Zustands der GCP-Umgebung und der Förderung von Leistungsverbesserungen. Durch die enge Zusammenarbeit mit Entwicklungs- und Supportteams tragen Sie dazu bei, eine hohe Verfügbarkeit, Belastbarkeit und ein nahtloses Erlebnis für ihre Kunden bei der Reise in die Cloud aufrechtzuerhalten. Darüber hinaus konzentrieren Sie sich auf die Kostenoptimierung, das Vorfallmanagement und die Verbesserung der Beobachtbarkeit über cloudbasierte Systeme hinweg. Hauptaufgaben: Automatisierung der Cloud-Infrastruktur. Entwerfen, Entwickeln und Warten der Cloud-Infrastruktur auf GCPI Python, Shell-Scripting usw. Sorgen Sie für bewährte Sicherheitspraktiken, Kostenoptimierung und Leistungsoptimierung und halten Sie sich an Governance-Standards für Cloud-Workloads. Standortzuverlässigkeit und Produktionsunterstützung. Kontinuierliche Überwachung und Sicherstellung von Integritätsprüfungen und Stabilität von GCP-Clustern, z. Google Kubernetes Engine (GKE), Compute Engine usw. Implementieren Sie automatisierte Integritätsprüfungen, Kapazitätsplanung und optimieren Sie die Leistung, um eine hohe Verfügbarkeit und Zuverlässigkeit sicherzustellen. Verbessern Sie die Beobachtbarkeit und Alarmierung mithilfe von Tools wie der Google Cloud Operational Suite (Stackdriver), Dynatrace, Splunk usw. Definieren und pflegen Sie Service Level Objectives (SLO), Service Level Indicators (SLIs) und Fehlerbudgets, um die Systemzuverlässigkeit zu verbessern. Überwachen, beheben und beheben Sie Produktionsvorfälle, um Ausfallzeiten und Unterbrechungen auf ein Minimum zu reduzieren. Führen Sie eine Ursachenanalyse (RCA) durch. um eine kontinuierliche Verbesserung voranzutreiben.Zusammenarbeit und betriebliche ExzellenzArbeiten Sie eng mit Entwicklungs- und Supportteams und Cloud-Ingenieuren zusammen, um die Anwendungsresilienz und die allgemeine Systemzuverlässigkeit zu verbessern.Verbessern Sie die Überwachungs-, Warn- und Selbstreparaturfunktionen, um manuelle Eingriffe zu minimieren.Unterstützen Sie Infrastruktur-Upgrades, Cloud-Migrationen und Plattformoptimierung.Entwickeln und pflegen Sie Playbooks, Runbooks und Automatisierungsskripte für optimierte Abläufe.Stellen Sie die Einhaltung von Sicherheitsrichtlinien, IAM-Konfigurationen und Gruppenstandards in allen Cloud-Infrastrukturen und -Prozessen sicher.Aufrechterhaltung der Stabilität und Zuverlässigkeit für die Unterstützung wichtiger Produktionssysteme Die Investitionsstrategie- und Ausführungsteams des Unternehmens verbessern die Technologieinfrastruktur des Unternehmens, um sie an ehrgeizige und dynamische Geschäftsziele anzupassen. Beheben Sie von Benutzern gemeldete Probleme umgehend und effektiv, diagnostizieren Sie die Grundursachen und implementieren Sie Maßnahmen, um ein erneutes Auftreten zu vermeiden. Helfen Sie bei der Weiterentwicklung der Integration des Unternehmens mit Cloud-Technologien (z. B. AWS, Docker, Kubernetes), um skalierbare und flexible Ressourcen für die Forschung bereitzustellen. Verbessern Sie Überwachungs- und Warnrahmen aktiv, um die Sichtbarkeit des Systemzustands sicherzustellen und schnelle Maßnahmen bei Leistungsproblemen zu ermöglichen. Einrichten und nehmen Sie an einer Bereitschaftsrotation teil, um außerhalb der Geschäftszeiten Unterstützung für kritische globale Vorgänge zu leisten. Unterstützen Sie die Stabilität der Anwendungen und stellen Sie sie sicher. Änderungs-, Vorfall- und Problemmanagement. Nehmen Sie an der Änderungsplanung, -bereitstellung und -überprüfung teil Fehlerbehebungen und andere proaktive Wartungsaktivitäten. Bewerten Sie die von Ihren Kunden gemeldeten Probleme, um fortlaufende Lösungen bereitzustellen. Nehmen Sie an der vom Manager zugewiesenen Bereitschaftsrotation teil. Bieten Sie bei Bedarf erweiterten Support und arbeiten Sie mit Offshore-Teams zusammen, um rund um die Uhr Unterstützung zu leisten
k-Unterstützung für Anwendungen und Dienste. Wichtige Anforderungen: Ausgeprägtes Fachwissen in GCP-Diensten wie Google Kubernetes Engine (GKE), Cloud Run, Compute Engine, Pub/Sub usw. Praktische Erfahrung mit Terraform, Ansible oder ähnlichen Tools für die Infrastrukturautomatisierung und -bereitstellungNachgewiesene Erfahrung im Aufbau und der Optimierung von CI/CD-Pipelines für RTL-Umgebungen mit Tools wie Jenkins, GitHub Actions, GitLab CI/CD usw. Erfahrung mit Überwachungs- und Observability-Tools wie Google Cloud Operations Suite (Stackdriver), Dynatrace, Splunk und umfassende Erfahrung in der Reaktion auf Vorfälle und Fehlerbehebung. Solides Verständnis von Netzwerken, Identitäts- und Zugriffsverwaltung (IAM), Cloud-Sicherheit und Best Practices. Nachgewiesene Fähigkeit, in agilen Teams zu arbeiten und effektiv mit dem Entwicklungs- und Betriebsteam zusammenzuarbeiten, um Systemstabilität und Hochverfügbarkeit sicherzustellen. Kundenorientierter, durchsetzungsfähiger technischer Leiter. Aufgrund der Menge an eingegangenen Bewerbungen können wir leider nicht auf alle antworten. Wenn Sie nicht innerhalb von 7 Tagen nach dem Absenden Ihrer Bewerbung eine Rückmeldung von uns erhalten, gehen Sie bitte davon aus, dass Sie nicht erfolgreich waren bei dieser Gelegenheit.

Arbeiten in Edinburgh, Midlothian

Entdecken Sie verwandte Möglichkeiten
Ähnliche Jobs
Fachberater für Medizinprodukte

Dragis-Pharm d.o.o. • Novi Sad, Beograd, Kragujevac, Kraljevo, Niš | Terenski rad

Elektroniker für Fahrzeuge

Srbijavoz a.d. • Beograd

Jobdetails
  • Jobtyp

    Full Time

  • Ort

    Edinburgh, Midlothian

  • Datum der Veröffentlichung

    April 02, 2026

Über das Unternehmen
Project Recruit
Register to Apply
/* Force browser cache refresh - Mon Jul 7 05:31:26 AM UTC 2025 */