Empresa: LTM
Site Reliability Engineer en LTM para garantizar la confiabilidad, escalabilidad y rendimiento de plataformas empresariales, con enfoque en automatización, Kubernetes, monitoreo y soporte 24x7. Remoto desde Toluca, México.
Experiencia con Kubernetes, monitoreo (Grafana, Prometheus, Alert Manager), CI/CD (Jenkins, Ansible, Terraform) y soporte de producción 24x7.
Gestionar y dar soporte a entornos de producción 24x7; automatizar procesos; implementar y mantener monitoreo; dar soporte a pipelines CI/CD; solucionar problemas de rendimiento y disponibilidad.
Python, Java o Go; Kubernetes; Grafana, Prometheus, Alert Manager; Jenkins, Ansible, Terraform; preferible AWS o GCP y AIOps.
Colaboración, resolución de problemas, pasión por la automatización y confiabilidad.
Tipo de Contrato
Tiempo completoIdioma
Inglés (no especificado, pero probablemente requerido)