Empleo de DevOps AWS en Guadalajara,JAL-114856-MX

Publicado hoy.

DevOps AWS en Capital Empresarial Horizonte

$ 80,000 a 90,000 MXN (Bruto)

Jalisco - Híbrido

Empleado de tiempo completo

Inglés : Nivel Avanzado

Capital Empresarial Horizonte Empresa Mexicana especialista en Recursos Humanos y Tecnologías de la Información solicita:

DevOps AWS 

Para laborar en Guadalajara 

Esquema Hibrido (2 días presencial y 3 en home office)

Inglés conversacional requerido


Requisitos técnicos indispensables
  • Experiencia práctica con Docker y Kubernetes.
  • Conocimientos de AWS y experiencia en administración de Amazon EKS.
  • Programación de scripts y automatización mediante Shell y Python.
  • Experiencia con herramientas de observabilidad y monitoreo: OpenTelemetry, Grafana, Prometheus y Splunk.
  • Conocimiento de los conceptos de SLA, SLO, SLI y Error Budgets.
  • Experiencia en diseño y mantenimiento de pipelines CI/CD.
  • Manejo de herramientas de control de versiones y automatización de despliegues, como GitHub y Jenkins.
  • Sólidas habilidades de diagnóstico, resolución de problemas y troubleshooting en sistemas distribuidos.
  • Conocimientos de sistemas operativos Linux/Unix y fundamentos de redes.
  • Experiencia en gestión y control de liberaciones de software en ambientes productivos.


Principales responsabilidades
  • Diseñar, desplegar y administrar aplicaciones contenerizadas utilizando Docker y Kubernetes en entornos de AWS, principalmente Amazon EKS.
  • Administrar, mantener y optimizar clústeres de Kubernetes, incluyendo pods, deployments, services, ingress y políticas de control de acceso basadas en roles (RBAC).
  • Automatizar tareas de infraestructura y operaciones mediante scripts desarrollados en Shell y Python.
  • Diseñar, implementar y mantener pipelines de integración continua y despliegue continuo (CI/CD) utilizando herramientas como GitHub y Jenkins.
  • Definir, monitorear y dar seguimiento a los acuerdos y objetivos de nivel de servicio (SLA, SLO y SLI), así como administrar los presupuestos de error (Error Budgets).
  • Garantizar la confiabilidad, disponibilidad, estabilidad y rendimiento de los sistemas y aplicaciones.
  • Implementar soluciones de observabilidad mediante OpenTelemetry para la recopilación y análisis de métricas, trazas y otros datos operativos.
  • Desarrollar y mantener dashboards en Grafana, así como configurar métricas, monitoreo y alertas utilizando Prometheus.
  • Administrar y analizar registros de eventos (logs), alertas e información operativa mediante Splunk.
  • Realizar análisis técnico y diagnóstico avanzado de problemas en sistemas distribuidos, identificando las causas raíz de fallas y degradaciones del servicio.
  • Liderar la respuesta a incidentes, realizar análisis de causa raíz (RCA) y coordinar reuniones posteriores a incidentes (post-mortems) para prevenir recurrencias.
  • Participar en esquemas de guardias operativas (on-call) para atender incidentes críticos y garantizar la continuidad de los servicios.
  • Gestionar liberaciones de software (release management), procurando despliegues seguros, controlados y con el menor impacto posible en los ambientes productivos.
  • Colaborar con los equipos de desarrollo, infraestructura, seguridad y operaciones para mejorar la automatización, la eficiencia operativa y la confiabilidad de las plataformas.


Conocimientos deseables
  • Experiencia o conocimientos en desarrollo con Java.
  • Conocimiento e integración de APIs REST.
  • Experiencia o exposición a servicios de nube de Alibaba Cloud (AliCloud).


Ofrecemos:

  • Horario de Oficina
  • Esquema 100% nomina
  • Sueldo abierto a negociación de acuerdo a experiencia
  • Prestaciones de Ley
  • Prestaciones superiores (SGMM familiar, SV 1 millón, Vales de despensa, 30 días de aguinaldo, PTU)