Líder de SRE

Full Time
Ubicacion Edinburgh, Midlothian
Publicado Abr 02, 2026

Aspectos destacados del trabajo

Full Time

Tipo de empleo

Edinburgh, Midlothian

Ubicacion

5 meses

Publicado

Solicitantes internacionales bienvenidos

Oportunidad potencial de permiso de trabajo

Este puesto puede estar abierto a candidatos internacionales con las calificaciones adecuadas. Comuníquese con el empleador para obtener detalles sobre el patrocinio de visas.

Por qué Imployii para quienes buscan empleo internacionalmente:
  • Acceso directo a empleadores con historial de patrocinio de visas
  • Visa de experto y orientación para reubicación
  • Coincidencia de prioridades para oportunidades transfronterizas
Edinburgh, …

Descripción del trabajo

Líder de SRE Nuestro cliente, un proveedor líder mundial de servicios de TI, necesita un Líder de SRE experimentado que esté basado en la oficina de su cliente en Edimburgo, Reino Unido. Este es un rol híbrido: puede trabajar de forma remota en el Reino Unido y asistir a la oficina de Edimburgo 2 días a la semana. Este es un contrato temporal de 6 meses (posible extenderse), para comenzar lo antes posible. Tarifa diaria: Tarifa de mercado competitiva. Descripción del rol: El cliente está buscando un ingeniero de confiabilidad del sitio (SRE) con experiencia para unirse a su Equipo de Plataforma Bancaria Cotidiana. En este rol, será responsable de garantizar la confiabilidad, la escalabilidad y el rendimiento de su infraestructura y aplicaciones en la nube en GCP. Se centrará en automatizar implementaciones de infraestructura, optimizar los canales de CI/CD, monitorear el estado del entorno de GCP e impulsar mejoras de rendimiento. Al colaborar estrechamente con los equipos de desarrollo y soporte, ayudará a mantener una alta disponibilidad, resiliencia y una experiencia perfecta para los viajes de sus clientes en la nube. Además, se centrará en la optimización de costos, la gestión de incidentes y la mejora de la observabilidad en los sistemas basados en la nube. Responsabilidades clave: Automatización de la infraestructura de la nubeDiseñar, desarrollar y mantener la infraestructura de la nube en GCPImplementar la infraestructura como un código usando herramientas como Terraform, Ansible, etc. para automatizar el aprovisionamiento de recursos de la nubeOptimizar y mantener canales de CI/CD para una implementación eficiente de aplicaciones y reversiones usando Jenkins, Github Actions o GitLab CI/CDAutomatizar las tareas operativas para mejorar la eficiencia usando lenguajes de scripting como Python. Shell Scripting, etc. Garantice las mejores prácticas de seguridad, optimización de costos y ajuste del rendimiento, cumpliendo con los estándares de gobernanza para cargas de trabajo en la nube Confiabilidad del sitio y soporte de producción Supervise y garantice continuamente los controles de estado y la estabilidad de los clústeres de GCP, por ejemplo. Google Kubernetes Engine (GKE), Compute Engine, etc. Implemente controles de estado automatizados, planificación de capacidad y optimice el rendimiento para garantizar una alta disponibilidad y confiabilidad. Mejore la observabilidad y las alertas utilizando herramientas como la suite operativa de la nube de Google (Stackdriver), Dynatrace, Splunk, etc. Defina y mantenga objetivos de nivel de servicio (SLO), indicadores de nivel de servicio (SLI) y presupuestos de errores para mejorar la confiabilidad del sistema. Supervise, solucione problemas y resuelva incidentes de producción asegurando un tiempo de inactividad e interrupciones mínimos. Realice análisis de causa raíz. (RCA) para impulsar la mejora continua. Colaboración y excelencia operativa Trabajar en estrecha colaboración con equipos de desarrollo y soporte e ingenieros de la nube para mejorar la resiliencia de las aplicaciones y la confiabilidad general del sistema Mejorar las capacidades de monitoreo, alertas y autocuración para minimizar la intervención manual Admitir actualizaciones de infraestructura, migraciones a la nube y optimización de la plataforma Desarrollar y mantener playbooks, runbooks y scripts de automatización para operaciones optimizadas Garantizar el cumplimiento de las políticas de seguridad, las configuraciones de IAM y los estándares de grupo en toda la infraestructura y los procesos de la nube Mantener la estabilidad y confiabilidad para lo esencial sistemas de producción que respaldan los equipos de ejecución y estrategia de inversión de la empresa Mejorar la infraestructura tecnológica de la empresa para alinearla con objetivos comerciales ambiciosos y dinámicos Abordar los problemas informados por los usuarios de manera rápida y efectiva, diagnosticando las causas fundamentales e implementando medidas para evitar la recurrencia Ayudar a promover la integración de las empresas con tecnologías en la nube (por ejemplo, AWS, Docker, Kubernetes) para ofrecer recursos escalables y flexibles para la investigación Mejorar activamente los marcos de monitoreo y alerta para garantizar la visibilidad del estado del sistema y permitir una acción rápida durante el desempeño problemasConfigure y participe en una rotación de guardia para brindar soporte fuera de horario para operaciones globales críticasSoporte y garantice la estabilidad de las aplicacionesGestión de cambios, incidentes y problemasParticipe en la planificación, implementación y revisión de cambiosRealice actividades de mantenimiento proactivo, participe en actividades de automatización y realice análisis y remediación de la causa raízEscriba y mantenga scripts para monitorear la funcionalidad y el rendimiento del sistemaEscriba scripts para automatizar múltiples tareas manualesMonitoree colas de incidentes, solucione problemas y dirija conferencias telefónicas con otros grupos para mitigar impactosAplicar correcciones de fallas de código y operación y otras actividades de mantenimiento proactivoEvaluar los problemas reportados por sus clientes para brindar soluciones continuasParticipar en la rotación de llamadas asignada por el gerenteProporcionar soporte extendido si es necesario y trabajar con equipos externos para facilitar todo el tiempo
k soporte para aplicaciones y servicios.Requisitos clave:Gran experiencia en servicios de GCP como Google Kubernetes Engine (GKE), Cloud Run, Compute Engine, Pub/Sub, etc.Experiencia práctica con Terraform, Ansible o herramientas similares para la automatización y el aprovisionamiento de infraestructuraExperiencia probada en la construcción y optimización de canales de CI/CD para entornos RTL utilizando herramientas como Jenkins, GitHub Actions, GitLab CI/CD, etc.Experiencia con herramientas de monitoreo y observabilidad como Google Cloud Operations Suite (Stackdriver), Dynatrace, Splunk y una sólida experiencia en respuesta a incidentes y resolución de problemas. Comprensión sólida de redes, gestión de identidades y acceso (IAM), seguridad en la nube y mejores prácticas. Capacidad demostrada para trabajar en equipos ágiles y colaborar eficazmente con el equipo de desarrollo y operaciones para garantizar la resiliencia y la alta disponibilidad del sistema. Líder de ingeniería asertivo y orientado al cliente. Debido al volumen de solicitudes recibidas, desafortunadamente no podemos responder a todos. Si no recibe respuesta nuestra dentro de los 7 días posteriores al envío de su solicitud, asuma que no ha tenido éxito. en esta ocasión.

trabajando en Edinburgh, Midlothian

Explorar oportunidades relacionadas
Trabajos similares
Especialista Comercial para Dispositivos Médicos

Dragis-Pharm d.o.o. • Novi Sad, Beograd, Kragujevac, Kraljevo, Niš | Terenski rad

tecnico en electronica de vehiculos

Srbijavoz a.d. • Beograd

Detalles del trabajo
  • Tipo de trabajo

    Full Time

  • Ubicacion

    Edinburgh, Midlothian

  • Fecha de publicación

    abril 02, 2026

Acerca de la empresa
Project Recruit
Register to Apply
/* Force browser cache refresh - Mon Jul 7 05:31:26 AM UTC 2025 */