DevOps- und SRE-Hiring hat eine grausame Asymmetrie: Die Rollen gehören zu den am längsten unbesetzten im Engineering, und die Kosten der Vakanz werden in der sichtbarsten Währung überhaupt bezahlt, Ausfälle, langsame Deployments und ein Plattformteam, das in Routinearbeit ertrinkt. Staff Augmentation passt gut zu dieser Disziplin, weil so viel der Arbeit projektförmig ist: Pipeline-Überholungen, Kubernetes-Migrationen, Observability-Rollouts, Infrastructure-as-Code-Refactorings. Aber es gibt einen ehrlichen Vorbehalt, der gute Augmentation von schlechter trennt: Reliability-Ownership, der Pager, lässt sich nicht an rotierende Externe auslagern, und so zu tun, als ob, ist der Weg, auf dem Augmentation in dieser Disziplin scheitert.
Wo DevOps-/SRE-Augmentation stark ist, und wo nicht
Die Trennlinie ist der Ownership-Horizont. Arbeit, die endet, eine Migration, ein Pipeline-Neubau, ein Observability-Rollout, ist ein natürliches Augmentation-Ziel: Erfahrene Externe haben dasselbe Projekt anderswo gemacht und bringen das Narbengewebe mit. Arbeit, die nie endet, Reliability besitzen, den Pager tragen, Quartal für Quartal für das Error Budget geradestehen, ist eine Planstelle, und Planstellen brauchen Angestellte. Der zu vermeidende Fehlmodus: eine externe "SRE" als Ersatz für dauerhafte Ownership einkaufen, weil die Festanstellungssuche schwer ist. Das Ergebnis ist Reliability-Theater, jemand pflegt Dashboards, die niemandem gehören.
| Arbeitstyp | Eignung | Warum |
|---|---|---|
| CI/CD-Pipeline-Überholung | Stark | Abgegrenzt, mustergetrieben, zwischen Unternehmen übertragbar |
| Kubernetes-/IaC-Migration | Stark | Von Natur aus zeitlich begrenzt, tiefe, aber mietbare Expertise |
| Observability-Rollout (Metriken, Tracing, Alerting) | Stark | Klar definiertes Liefergut mit eindeutigem Fertig-Zustand |
| Cloud-Kostenoptimierung | Stark | Kurz, hoher ROI, profitiert von frischem Außenblick |
| Temporäre On-Call-Verstärkung in einer Krisenphase | Mittel | Mit Runbooks monateweise machbar; keine dauerhafte Antwort |
| Primäre 24/7-Bereitschaft und Reliability-Ownership | Schwach | Ownership-Arbeit; Verantwortung muss jeden Vertrag überdauern |
Skill-Profil und Vetting-Signale
Jeder Lebenslauf in diesem Markt nennt Kubernetes, Terraform, AWS/Azure/GCP und "CI/CD". Die unterscheidenden Signale sind operativ: Hat diese Person Produktionsverantwortung getragen, oder hat sie Tools neben Leuten konfiguriert, die es taten? Ein nützlicher Vetting-Rahmen: den Großteil des Gesprächs auf Incidents und Toil verwenden, nicht auf Tool-Quizfragen.
| Bereich | Starkes Signal | Warnsignal |
|---|---|---|
| Incident-Erfahrung | Geht echte Incidents durch, die sie geführt hat: Erkennung, Kommunikation, Eindämmung, Postmortem | Hat nur an Incidents "teilgenommen"; keine Geschichte, in der sie den Stift hielt |
| SLO-Denken | Rahmt Reliability als Error Budgets und nutzerbezogene Ziele | Reliability als "überall mehr Neunen" oder reines Uptime-Gerede |
| Automatisierungsinstinkt | Konkrete Geschichten über gemessenen und beseitigten Toil | Stolz auf heroische manuelle Eingriffe |
| IaC-Disziplin | Alles über Code-Review und State-Management; spricht ehrlich über Drift | Console-first-Arbeitsweise, IaC als Nachgedanke |
| Security-Hygiene | Least Privilege, Secrets-Management, Supply-Chain-Bewusstsein unaufgefordert | Security wird als Job eines anderen Teams behandelt |
Engagement-Formen und realistische Laufzeiten
Das erfolgreichste Muster, das wir sehen, ist "bauen, während Sie einstellen": Externe liefern die Plattformverbesserungen jetzt, dokumentieren im Vorbeigehen und übergeben an die Festangestellten, die Ihre langsamere Suche irgendwann findet. Das beseitigt die falsche Wahl zwischen sechs Monaten Warten auf ein SRE-Einhorn und einer überhasteten mittelmäßigen Festeinstellung.
| Form | Typische Dauer | Anmerkungen |
|---|---|---|
| Plattformprojekt (Pipeline, Migration, Observability) | 3-6 Monate | Klares Liefergut, natürliches Enddatum |
| Brücke: bauen, während eingestellt wird | 4-9 Monate | Externe Kapazität, während die Festanstellungssuche parallel läuft |
| Eingebettete Senior-SRE im bestehenden Team | 6-12 Monate | Hebt die operative Reife des Teams; Wissenstransfer ist Teil des Jobs |
| Fractional Platform Lead | 3-6 Monate, Teilzeit | Setzt Standards und reviewt; ersetzt keinen dauerhaften Owner |
Integration konkret: Zugriffe, On-Call und Runbooks
DevOps-Externe brauchen breiteren Infrastrukturzugriff als die meisten anderen Augmentation-Rollen, was diszipliniertes Onboarding nicht verhandelbar macht: gescopte IAM-Rollen, MFA mit Hardware-Key, Break-Glass-Prozeduren ohne Externe und Audit-Logging ab Tag eins. On-Call verdient explizite Vertragssprache: ob die externe Person überhaupt in die Rotation einsteigt, in welchen Stufen und Zeiten, zu welcher Vergütung, Unklarheit erzeugt hier Groll oder, schlimmer, einen Pager ohne Owner.
| Punkt | Ziel | Anmerkungen |
|---|---|---|
| Gescopte IAM-Rollen, MFA, Audit-Logging | Tag 1-2 | Least Privilege; niemals geteilte Admin-Konten |
| Runbook- und Architektur-Walkthrough | Woche 1 | Zahlt sich sofort in Incident-Bereitschaft aus |
| On-Call-Bedingungen schriftlich vereinbart | Vor Start | Rotationsteilnahme, Stufen, Zeiten, Vergütung |
| Erste reviewte Infrastrukturänderung ausgeliefert | Woche 1-2 | Über denselben PR-Pfad wie bei Angestellten |
| Wissenstransfer-Rhythmus terminiert (Doku + Pairing) | Woche 2 | Nicht für die letzte Woche aufgespart |
Tagessatz-Kontext, und wann umwandeln
Als breite Marktbeobachtung für DACH und vergleichbare europäische Märkte 2026: DevOps- und SRE-Tagessätze liegen leicht über allgemeinen Backend-Sätzen, was Knappheit und die enthaltene Produktionsverantwortung widerspiegelt. Die Spannen unten sind reine Orientierung, Cloud-Zertifikate zählen weniger als echte Incident-Historie, und regulierte Branchen zahlen zum oberen Rand. In Festanstellung umwandeln, wenn das Engagement stillschweigend zu Ownership geworden ist: Die externe Person wird zuerst angerufen, weiß als Einzige, warum der Cluster so aussieht, ist der De-facto-Plattform-Lead. Ein guter Partner wertet Umwandlung als Erfolg, und die Konditionen sollten von Tag eins an im Vertrag stehen.
| Profil | Indikativer Tagessatz (EUR) | Anmerkungen |
|---|---|---|
| Mid-Level DevOps Engineer | ≈ 650-900 | CI/CD, Container, solide Cloud-Grundlagen |
| Senior DevOps / Platform Engineer | ≈ 850-1.150 | Das typische Augmentation-Profil für Plattformprojekte |
| Senior SRE (SLO-/Incident-Tiefe) | ≈ 900-1.250 | Knapp; echte Produktions-Ownership-Historie trägt den Aufschlag |
| Platform-Architekt:in / Fractional Lead | ≈ 1.000-1.400 | Oft Teilzeit; Fokus auf Standards und Review |
