Senior Elastic / OpenSearch Operations Engineer (m/w/d)
Netlution GmbHÜber unseren Kunden
Aufgabenspektrum
Werde Teil eines Teams, das geschäftskritische Observability- und Logging-Plattformen auf Enterprise-Niveau betreibt.
Du verfügst über fundierte Erfahrung mit Elasticsearch, OpenSearch oder dem ELK Stack? Du interessierst dich für den stabilen Betrieb hochverfügbarer Plattformen, komplexes Troubleshooting und die Analyse technischer Incidents? Dann suchen wir genau dich.
Als Senior Elastic / OpenSearch Operations Engineer (m/w/d) verantwortest du den Betrieb einer geschäftskritischen Logging- und Observability-Plattform im Enterprise-Umfeld. Gemeinsam mit internationalen Teams sorgst du dafür, dass Milliarden von Log-Daten zuverlässig verarbeitet, analysiert und bereitgestellt werden.
Dabei arbeitest du mit modernen Technologien wie OpenSearch, Elasticsearch, Grafana, Prometheus, Kubernetes und Automatisierungslösungen und übernimmst eine zentrale Rolle im Plattformbetrieb.
Deine Aufgaben sind folgende:
- Betrieb, Überwachung und Optimierung großer Elasticsearch- und OpenSearch-Plattformen
- Analyse und Behebung von Incidents im 2nd- und 3rd-Level-Support
- Durchführung von Root Cause Analysen und nachhaltige Fehlerbehebung
- Sicherstellung von Verfügbarkeit, Performance und Stabilität geschäftskritischer Systeme
- Überwachung der Cluster-Gesundheit sowie Troubleshooting komplexer Plattformstörungen
- Optimierung von Index-, Sharding- und Storage-Konzepten
- Weiterentwicklung von Monitoring- und Observability-Lösungen
- Zusammenarbeit mit internationalen DevOps-, SRE- und Platform-Teams
- Automatisierung wiederkehrender Betriebsaufgaben
- Erstellung und Pflege von Runbooks, Betriebsdokumentationen und Best Practices
- Mitarbeit in einer 24/7-Betriebsorganisation und On-Call-Struktur
Erfahrungen
Das bringst du mit:
Must-have
- Mehrjährige Erfahrung als:
- Elastic Engineer
- OpenSearch Engineer
- ELK Engineer
- Site Reliability Engineer
- Platform Operations Engineer
- Observability Engineer
- Praktische Erfahrung mit Elasticsearch und/oder OpenSearch
- Erfahrung im Betrieb produktiver Logging- oder Monitoring-Plattformen
- Kenntnisse in:
- Cluster Operations
- Sharding
- Replication
- Index Management
- Performance Tuning
- Incident Management
- Sehr gute Linux-Kenntnisse
- Erfahrung mit Monitoring- und Observability-Lösungen
- Gute Englisch- und Deutschkenntnisse in Wort und Schrift
- Kubernetes
- Helm
- ArgoCD
- Prometheus
- Grafana
- OpenTelemetry
- Kafka
- Python
- Bash
- Ansible
- Infrastructure as Code
- Cloud-Technologien (AWS, Azure oder GCP)