Descripción
Buscamos un **Ingeniero del Centro Global de Operaciones / Ingeniero de Confiabilidad de Sitios (SRE) / perfil DevOps** con experiencia en supervisión, gestión de incidencias, operaciones en la nube, soporte en producción y confiabilidad de servicios.
Este puesto se centra en garantizar la disponibilidad, estabilidad y rendimiento de plataformas y servicios críticos. Trabajarás cerca de entornos de producción, supervisando infraestructura y aplicaciones, identificando incidencias, realizando una solución inicial de problemas, escalando cuando sea necesario y contribuyendo a mejorar la confiabilidad operativa.
**Este no es un puesto básico de centro de ayuda (helpdesk).** Buscamos a alguien con una mentalidad sólida orientada a las operaciones, experiencia práctica en supervisión y conocimientos suficientes sobre la nube para comprender alertas, investigar problemas y brindar soporte efectivo en entornos de producción.
**Sus responsabilidades serán**
* Supervisar infraestructura, aplicaciones, servicios, registros (logs), métricas y alertas mediante herramientas como Datadog, Splunk, ServiceNow o plataformas similares.
* Detectar, analizar, solucionar y escalar incidencias en producción.
* Realizar revisiones del estado del sistema y validar la estabilidad operativa de plataformas basadas en la nube.
* Revisar alertas, registros (logs), paneles de control (dashboards) y métricas para identificar posibles problemas y reducir interrupciones del servicio.
* Seguir procedimientos operativos estándar (SOP) documentados, manuales de procedimientos (runbooks) y protocolos de escalación.
* Documentar de forma clara y precisa las incidencias, acciones realizadas, causas raíz y actualizaciones operativas.
* Apoyar los procesos de gestión de incidencias mediante herramientas de gestión de tickets, como ServiceNow.
* Colaborar con equipos de ingeniería, DevOps, nube y soporte para mejorar la confiabilidad y los procesos de respuesta.
* Contribuir a la mejora continua de las prácticas de supervisión, alertas, automatización, documentación y soporte en producción.
* Participar en turnos rotativos los fines de semana o días festivos, según sea necesario.
**Requisitos obligatorios**
* **2\-4 años de experiencia** en uno o más de los siguientes puestos: GOC, NOC, SRE, DevOps, Operaciones de TI, Operaciones en la nube, Soporte en producción o Soporte de supervisión.
* **Al menos 2 años de experiencia práctica en supervisión** en entornos de producción u operativos.
* Experiencia trabajando con herramientas de supervisión / observabilidad como Datadog, Splunk, Prometheus, Grafana o similares.
* **Conocimientos intermedios de AWS**, idealmente con 2\-3 años de exposición práctica, o conocimientos avanzados / expertos en GCP.
* Familiaridad con comandos Linux, verificaciones del sistema, análisis de registros (logs) y solución de incidencias.
* Experiencia trabajando con herramientas de gestión de tickets o gestión de incidencias, preferiblemente ServiceNow.
* Comprensión de entornos de soporte en producción, escalación de incidencias, disciplina operativa y disponibilidad del servicio.
* Excelentes habilidades de comunicación escrita y hábitos disciplinados de documentación.
* **Disponibilidad para trabajar presencialmente** en la Ciudad de México (CDMX) o Querétaro (QRO).
* **Disponibilidad para trabajar en uno de los turnos definidos alineados con el horario del Pacífico (PST):** 10:00\-19:00 o 11:00\-20:00 hora de México.
* Disponibilidad para participar en turnos rotativos los fines de semana y días festivos, según sea necesario.
**Deseable**
* ·Experiencia en creación de scripts o automatización con Bash, Python o similares.
* Exposición a entornos CI/CD o prácticas DevOps.
* Experiencia apoyando sistemas nativos de la nube, distribuidos o de alta disponibilidad.
* Conocimientos sobre ajuste de alertas, paneles de control (dashboards), métricas operativas y prácticas de confiabilidad.
* Experiencia previa en entornos con servicios críticos para el negocio.
* Experiencia mejorando la documentación operativa, manuales de procedimientos (runbooks) o procedimientos de respuesta ante incidencias.
**Qué no buscamos**
* Perfiles con únicamente experiencia básica en centros de ayuda (helpdesk) y sin antecedentes en supervisión.
* Candidatos sin disponibilidad para el horario definido alineado con el PST.
* Candidatos que requieran turnos rotativos completos; este puesto se basa en turnos fijos definidos, con rotaciones solo los fines de semana o días festivos cuando sea necesario.
* Perfiles sin exposición práctica a entornos en la nube.
* Candidatos cuyos conocimientos sobre herramientas de supervisión sean exclusivamente teóricos, sin experiencia real en soporte en producción.
* Perfiles centrados únicamente en desarrollo, sin experiencia en soporte en producción, supervisión, operaciones en la nube ni confiabilidad.
**Condiciones laborales**
* Puesto presencial en la Ciudad de México (CDMX) o Querétaro (QRO), México.
* Horario laboral fijo alineado con el horario del Pacífico (PST).
* Posibles horarios: 10:00\-19:00 o 11:00\-20:00 hora de México.
* Puede requerirse participación en turnos rotativos los fines de semana y días festivos, según necesidades operativas.
* El trabajo los fines de semana y días festivos se remunerará conforme a la ley laboral mexicana.
* Este puesto se enfoca en la supervisión y el soporte en producción, pero no constituye un rol de turnos rotativos 24/7.
**Qué ofrecemos**
* Esquema de nómina al 100 %.
* Contrato indefinido.
* Prestaciones legales.
* Seguro médico mayor.
* Seguro dental.
* Clases de inglés.
* Bonificación por referencias.
* Una cultura cercana y colaborativa, con espíritu familiar.
* Un entorno 100 % tecnológico, en constante contacto con la innovación y las nuevas tecnologías.
* La oportunidad de crecer en una empresa donde realmente importan la tecnología, la especialización y las personas.
Tipo de empleo: Tiempo completo
Remuneración: $80,000\.00 \- $85,000\.00 por mes
Ubicación del trabajo: Presencial