Deine Aufgaben Wir nutzen kein AWS. Wir betreiben unsere eigenen Kubernetes-Cluster, deployen über GitOps, und unser fünfköpfiges Team liefert schneller als Unternehmen mit zehnmal so vielen Leuten. amaiko baut KI, die direkt in Microsoft Teams lebt — kein zusätzliches Tool, kein zusätzliches Login. Wir sind ein wachsendes SaaS-Unternehmen aus Bayern, und unsere Plattform deckt alles ab: von natürlicher Sprache über Dokumentenerstellung bis hin zur Microsoft-365-Integration. Alles multi-tenant-fähig, alles auf Infrastruktur, die wir selbst aufgebaut haben und betreiben. Wir suchen eine:n Senior SRE, die/der diese Infrastruktur von A bis Z verantwortet. Was dich erwartet Unsere Kubernetes-Infrastruktur betreiben und weiterentwickeln — Cluster, Netzwerk, Storage, Ingress, Zertifikate. Die Plattform, auf der unser Produkt läuft, gehört dir. Die Deployment-Pipeline verantworten — alles läuft über GitOps. Ein neuer Tenant ist ein Git-Commit. Ein Deployment ist ein Merge auf Main. Du hältst das so — und machst es besser. Infrastructure as Code bauen — Provisionierung, Skalierung, Recovery. Reproduzierbar, versioniert, keine Snowflakes. Unsere Multi-Tenant-Architektur skalieren — jeder Kunde bekommt isoliertes Compute, Storage und Netzwerk. Du machst das für zehn Tenants und für tausend. Observability nützlich machen — Traces, Logs, Alerts. Kein Dashboard, das niemand öffnet. Monitoring, das dir sagt, dass etwas nicht stimmt, bevor es der Kunde merkt. Incidents und Bereitschaft übernehmen — für ein System, das du mitgestaltet hast. Root-Cause-Analyse, Postmortems, nachhaltige Fixes statt Pflaster. Security und Compliance — DSGVO, Backup-Strategien, Secret Management, Patching. Kein Theater — die echte Arbeit. Dein Profil Mehrjährige Erfahrung mit Kubernetes in Production — echte Incidents, nicht nur Zertifikate Infrastructure as Code (Terraform) als Erstsprache Netzwerk-Grundlagen, die sitzen — DNS, TLS, Ingress, Firewalls. Du analysierst, statt zu googlen. Erfahrung mit Monitoring und Alerting, das tatsächlich funktioniert Security-Verständnis — keine Compliance-Checklisten, sondern echtes Gespür für Angriffsflächen und Risiken Routine mit CI/CD-Pipelines und Container-Workflows Deutsch und Englisch — unser Team und unsere Dokumentation sind zweisprachig Nice to have Erfahrung mit europäischen Cloud-Anbietern GitOps-Tooling (ArgoCD, Flux oder Vergleichbares) Beiträge zu Open-Source-Infrastrukturprojekten Warum wir? Remote in ganz Deutschland — Büro in Viechtach (Bayern), falls du Berge magst Ein Team von fünf Leuten — du hast echten Einfluss darauf, wie wir bauen und betreiben. Keine Ticket-Warteschlange. Moderner Stack, kein Legacy — deine Entscheidungen landen direkt in Production Eine Rolle, die zählt — wir sind an dem Punkt, an dem die richtige SRE-Person die Richtung des Unternehmens verändert
Site Reliability Engineer - Compute System & Network (f/m/d)
Exoscale
Site Reliability Engineer (f/m/d) – Observability & Internal Tools
Bertelsmann
Senior Site Reliability Engineer (m/f/d)
TOPdesk
(Senior) Cloud Site Reliability Engineer (Platform) (m/f/x)
Scalable GmbH
(Junior) Cloud Site Reliability Engineer (Network) (m/f/x)
Scalable GmbH
Senior Site Reliability Engineer (x/f/m)
Doctolib