SRE Enviar solicitud Site Reliability Engineer (SRE) Descripción de la compañía Compañía de referencia del sector aéreo que está impulsando su transformación tecnológica mediante soluciones orientadas a mejorar la eficiencia, automatización y escalabilidad de sus operaciones. Su área tecnológica trabaja con equipos de producto y metodologías ágiles para desarrollar y operar servicios críticos, con especial atención a la estabilidad, rendimiento, seguridad e innovación tecnológica. Misión y ubicación del puesto Buscamos un/a Site Reliability Engineer (SRE) para asumir un papel clave en la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios críticos. La posición combina aproximadamente un 75% de componente técnico y un 25% de gestión y coordinación , por lo que buscamos una persona con sólida experiencia técnica que también pueda ejercer liderazgo, coordinar equipos y actuar como referente en materia de fiabilidad y operaciones. La posición está ubicada en La Muñoza (Madrid) . Descripción de responsabilidades Operar y optimizar la infraestructura sobre AWS , garantizando su fiabilidad, escalabilidad y eficiencia. Definir y evolucionar la estrategia de observabilidad y monitorización , utilizando herramientas como Dynatrace para anticipar, detectar y mitigar incidencias. Garantizar la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios. Actuar como referente técnico y service owner, coordinándose con equipos de soporte, desarrollo, infraestructura, arquitectura, ciberseguridad y FinOps. Liderar la respuesta ante incidentes críticos y coordinar análisis post-incidente orientados a identificar causas raíz y aplicar soluciones sostenibles. Trabajar con SLIs, SLOs, SLAs y KPIs , asegurando el cumplimiento de los niveles de servicio establecidos. Automatizar tareas operativas para reducir el trabajo manual y el operational toil . Colaborar con los equipos de desarrollo en la evolución de pipelines CI/CD y la adopción de buenas prácticas DevSecOps , utilizando GitHub. Mantener una postura sólida de seguridad cloud mediante herramientas como WIZ y contribuir al cumplimiento de requisitos de auditoría. Gestionar la obsolescencia tecnológica y el ciclo de vida de componentes de infraestructura. Diseñar y validar estrategias de Disaster Recovery , asegurando el cumplimiento de los objetivos RTO/RPO. Crear y mantener runbooks operativos, informes de incidentes y planes de mejora de fiabilidad. Liderar y acompañar a los equipos de soporte y operaciones, fomentando una cultura de ownership y mejora continua. Requisitos esenciales Experiencia sólida trabajando como Site Reliability Engineer, Cloud Engineer, DevOps Engineer o en posiciones similares dentro de entornos de producción críticos. Experiencia práctica operando workloads en AWS , incluyendo servicios como EC2, ECS, S3, IAM o CloudWatch. Experiencia con plataformas de observabilidad y monitorización, especialmente Dynatrace . Conocimiento sólido de los principios SRE y experiencia trabajando con SLIs, SLOs y SLAs . Experiencia en gestión y resolución de incidentes, análisis de causa raíz y mejora de la fiabilidad de sistemas. Experiencia con GitHub y workflows de CI/CD. Capacidad para desarrollar automatizaciones que reduzcan tareas manuales y carga operativa. Experiencia coordinando o liderando equipos técnicos de soporte u operaciones. Conocimientos de seguridad, cumplimiento operativo y procesos de auditoría. Capacidad de liderazgo, comunicación y colaboración con equipos técnicos multidisciplinares. Requisitos deseables Titulación en Ingeniería Informática, Sistemas de Información, Ingeniería Aeronáutica/Aeroportuaria o disciplinas relacionadas. Certificaciones de AWS , como Solutions Architect, SysOps Administrator o equivalentes. Experiencia con Terraform para automatización de infraestructura. Familiaridad con herramientas de seguridad cloud como WIZ . Conocimientos de ITIL y frameworks de gestión de incidentes. Experiencia trabajando con metodologías Agile y prácticas DevSecOps. Conocimientos de gestión del ciclo de vida y obsolescencia de componentes tecnológicos. Por qué unirse a la compañía Tendrás la oportunidad de trabajar en un entorno tecnológico de alta criticidad donde la fiabilidad, automatización y escalabilidad tienen un impacto directo en el negocio. Es una posición con un peso técnico elevado y capacidad real para influir en la evolución de las operaciones, impulsar prácticas SRE y trabajar transversalmente con ingeniería, arquitectura, ciberseguridad y FinOps. Departamento Development Ubicaciones Madrid Estado remoto Híbrido Número de vacantes 1 Experiencia mínima 7 Experiencia máxima 15 Skills (separadas por coma) AWS, Dynatrace, SRE Beneficios Seguro médico, Ticket guarderia, Descuentos en productos/servicios de la empresa Acerca de TalentHackers TalentHackers es la compañía del grupo Catenon especializada en reclutamiento de perfiles tecnológicos y digitales. Nace en el año 2019 con el propósito de transformar la industria a través de la inteligencia del dato y recompensar justamente a quien aporta valor gracias a la tecnología nodal y a su sistema de referencias pagadas. Fundada en 2019 Compañeros 25-50
Senior IT Operations / SRE
Tecdata Engineering
Senior Technical Support Engineer (SRE)
Nutanix
Senior Data SRE / Cloud Platform Engineer
Flywire
Coordinador SRE & Observabilidad
Sanitas
Site Reliability Engineer (SRE) | Feeld
GT
DevOps / SRE Engineer
Ogury