Publicado hoy.
DevOps AWS en Capital Empresarial Horizonte
$ 80,000 a 90,000 MXN (Bruto)
Jalisco - Híbrido
Empleado de tiempo completo
Inglés : Nivel Avanzado
Capital Empresarial Horizonte Empresa Mexicana especialista en Recursos Humanos y Tecnologías de la Información solicita:
DevOps AWS
Para laborar en Guadalajara
Esquema Hibrido (2 días presencial y 3 en home office)
Inglés conversacional requerido
- Experiencia práctica con Docker y Kubernetes.
- Conocimientos de AWS y experiencia en administración de Amazon EKS.
- Programación de scripts y automatización mediante Shell y Python.
- Experiencia con herramientas de observabilidad y monitoreo: OpenTelemetry, Grafana, Prometheus y Splunk.
- Conocimiento de los conceptos de SLA, SLO, SLI y Error Budgets.
- Experiencia en diseño y mantenimiento de pipelines CI/CD.
- Manejo de herramientas de control de versiones y automatización de despliegues, como GitHub y Jenkins.
- Sólidas habilidades de diagnóstico, resolución de problemas y troubleshooting en sistemas distribuidos.
- Conocimientos de sistemas operativos Linux/Unix y fundamentos de redes.
- Experiencia en gestión y control de liberaciones de software en ambientes productivos.
- Diseñar, desplegar y administrar aplicaciones contenerizadas utilizando Docker y Kubernetes en entornos de AWS, principalmente Amazon EKS.
- Administrar, mantener y optimizar clústeres de Kubernetes, incluyendo pods, deployments, services, ingress y políticas de control de acceso basadas en roles (RBAC).
- Automatizar tareas de infraestructura y operaciones mediante scripts desarrollados en Shell y Python.
- Diseñar, implementar y mantener pipelines de integración continua y despliegue continuo (CI/CD) utilizando herramientas como GitHub y Jenkins.
- Definir, monitorear y dar seguimiento a los acuerdos y objetivos de nivel de servicio (SLA, SLO y SLI), así como administrar los presupuestos de error (Error Budgets).
- Garantizar la confiabilidad, disponibilidad, estabilidad y rendimiento de los sistemas y aplicaciones.
- Implementar soluciones de observabilidad mediante OpenTelemetry para la recopilación y análisis de métricas, trazas y otros datos operativos.
- Desarrollar y mantener dashboards en Grafana, así como configurar métricas, monitoreo y alertas utilizando Prometheus.
- Administrar y analizar registros de eventos (logs), alertas e información operativa mediante Splunk.
- Realizar análisis técnico y diagnóstico avanzado de problemas en sistemas distribuidos, identificando las causas raíz de fallas y degradaciones del servicio.
- Liderar la respuesta a incidentes, realizar análisis de causa raíz (RCA) y coordinar reuniones posteriores a incidentes (post-mortems) para prevenir recurrencias.
- Participar en esquemas de guardias operativas (on-call) para atender incidentes críticos y garantizar la continuidad de los servicios.
- Gestionar liberaciones de software (release management), procurando despliegues seguros, controlados y con el menor impacto posible en los ambientes productivos.
- Colaborar con los equipos de desarrollo, infraestructura, seguridad y operaciones para mejorar la automatización, la eficiencia operativa y la confiabilidad de las plataformas.
- Experiencia o conocimientos en desarrollo con Java.
- Conocimiento e integración de APIs REST.
- Experiencia o exposición a servicios de nube de Alibaba Cloud (AliCloud).
Ofrecemos:
- Horario de Oficina
- Esquema 100% nomina
- Sueldo abierto a negociación de acuerdo a experiencia
- Prestaciones de Ley
- Prestaciones superiores (SGMM familiar, SV 1 millón, Vales de despensa, 30 días de aguinaldo, PTU)