Site Reliability Engineer — Mexico City Metropolitan Area

Vacante

Site Reliability Engineer

Fulcrum Digital IncFulcrum Digital Inc
Tiempo completo Mexico City Metropolitan Area

Vacante indexada automáticamente desde LinkedIn. TG Empleos no intermedia este proceso.

Compartir:

Análisis Técnico de Tec Gurus

El Site Reliability Engineer se encarga de garantizar la estabilidad y rendimiento de plataformas en producción, impulsando la automatización, el monitoreo y las mejores prácticas DevOps. Su trabajo reduce incidentes y mejora la resiliencia del stack tecnológico mediante Kubernetes, AWS y pipelines CI/CD.

LinuxSplunk y DynatraceITIL/ITSMSQL y PL/SQLJenkins y CI/CDGroovy, YAML y ShellGit y BitbucketKubernetes y AWSMonitoreo y alertasAnálisis de causa raíz

Descripción

Empresa: Fulcrum Digital Inc

Site Reliability Engineer responsable de la salud, estabilidad y rendimiento de entornos de producción, monitoreo, automatización CI/CD, Kubernetes y AWS, con enfoque en reducción de incidentes y mejora de resiliencia.

Experiencia requerida

Experiencia sólida en soporte de producción y liderazgo de equipos de operaciones, con conocimientos en Linux, monitoreo, ITIL/ITSM, SQL/PLSQL, CI/CD, Kubernetes y AWS.

Responsabilidades

Planificar y gestionar el entorno de producción; definir estrategias de monitoreo y optimización; responder a incidentes; automatizar despliegues y operaciones; mantener servicios midiendo disponibilidad y latencia; participar en guardias rotativas.

Conocimientos técnicos

Linux, Splunk, Dynatrace, ITIL/ITSM, SQL, PL/SQL, Jenkins, CI/CD, Groovy, YAML, Shell, Git, Bitbucket, Kubernetes, AWS, monitoreo y alertas, análisis de causa raíz, disaster recovery.

Habilidades

Mentalidad de propiedad de servicio, comunicación efectiva, trabajo en equipo distribuido globalmente, resolución de problemas complejos, mejora continua y reducción de trabajo repetitivo.

Experiencia

Experiencia sólida en soporte de producción y liderazgo de equipos de operaciones, con conocimientos en Linux, monitoreo, ITIL/ITSM, SQL/PLSQL, CI/CD, Kubernetes y AWS.

Conocimientos

Linux, Splunk, Dynatrace, ITIL/ITSM, SQL, PL/SQL, Jenkins, CI/CD, Groovy, YAML, Shell, Git, Bitbucket, Kubernetes, AWS, monitoreo y alertas, análisis de causa raíz, disaster recovery.

Habilidades

Mentalidad de propiedad de servicio, comunicación efectiva, trabajo en equipo distribuido globalmente, resolución de problemas complejos, mejora continua y reducción de trabajo repetitivo.

Actividades

Planificar y gestionar el entorno de producción; definir estrategias de monitoreo y optimización; responder a incidentes; automatizar despliegues y operaciones; mantener servicios midiendo disponibilidad y latencia; participar en guardias rotativas.

Idiomas

Inglés - Avanzado

Datos Generales

Tipo de Contrato

Tiempo completo

Idioma

Inglés - Avanzado
Site Reliability EngineerFulcrum Digital Inc
Postúlate ahora🔔 Recibir alertas