Descripción de la oferta
Actualmente estamos en búsqueda varios perfiles Cloud Operations & SRE Engineer, para una posición estable.
Responsabilidades clave:
Monitorización avanzada y respuesta a incidentes: Liderar la monitorización de la infraestructura y gestionar incidentes complejos, realizando análisis de causa raíz e implementando soluciones a largo plazo.
Infraestructura como código (IaC): Diseñar, implementar y mantener soluciones robustas de automatización de infraestructura utilizando herramientas como Terraform y GitHub Actions.
Optimización del rendimiento y la fiabilidad: Identificar y solucionar cuellos de botella de rendimiento, optimizar el uso de recursos y garantizar la alta disponibilidad de los servicios.
Gestión de pipelines de CI/CD: Supervisar el diseño y el mantenimiento de pipelines de CI/CD, garantizando despliegues de infraestructura fluidos y fiables.
Colaboración: Trabajar en estrecha colaboración con otros equipos (responsables de la aplicación, equipo de ingeniería y soporte de SLZ) para garantizar que los productos cumplan su función, al tiempo que se asegura la alineación con las estrategias técnicas y los objetivos operativos.
Para esta posición se requiere realizar por parte del recurso una serie de Disponibilidades e intervenciones que quedarían encajadas aproximadamente de esta forma:
- Disponibilidades 1 semana completa al mes
- Intervenciones aproximadamente 4-8 horas al mes, agrupadas en 1 o 2 intervenciones al mes, dependiendo de la duración de cada intervención
Requisitos mínimos:
Como se requiere varios perfiles Senior y Lead, la experiencia requerida variará, partiendo de al menos 3 años en lo siguientes puntos:
AWS: Conocimientos extensivos en servicios y gestión de AWS.
Landing Zone (LZ), Direct Connect, AWS Organizations, SCP's: Conocimientos avanzados en configuración y gestión de entornos seguros y conectividad en AWS.
EKS, CI/CD, Kubernetes: Experiencia en orquestación de contenedores y pipelines de integración y despliegue continuo.
Infrastructure as Code (Terraform, GitHub Actions): Diseño e implementación de infraestructura automatizada mediante código.
Monitoring and Incident Response: Experiencia en monitorización avanzada y gestión de incidentes con análisis de causa raíz y soluciones a largo plazo.
Inglés
Modalidad de trabajo: Remoto
World Software Services es una empresa multinacional con más de 40 años de experiencia, destacando en los campos de consultoría, desarrollo informático y servicios BPO. Atendemos a empresas de todo el mundo, contando con oficinas en México, Estados Unidos, España, Portugal, Colombia, Perú y Chile.