ITSM Lead _ Resilient Manager
- Verfügbarkeit einsehen
- 1 Referenz
- 85€/Stunde
- 22763 Altona
- National
- de | en
- 02.08.2026
Kurzvorstellung
Auszug Referenzen (1)
"Mr.S. worked reliably as a freelance Technical Product Owner, demonstrating strong expertise, structure, and excellent collaboration skills."
8/2022 – 11/2023
Tätigkeitsbeschreibung
- Leitung der Entwicklung von drei Services einer SaaS-Plattform für die öffentliche Verwaltung mit einem dedizierten SRE-Ansatz zur Sicherstellung von Service-Stabilität
• Verantwortung für SRE-relevante Themen wie Service-Stabilität, Monitoring und Incident Management, integriert in die Produktverantwortung, mit Einführung von Service Level Objectives (SLOs) zur Priorisierung technischer Anforderungen
• Reduktion der durchschnittlichen Incident-Zeit um 60% (von durchschnittlich 48 auf ca. 19 Stunden) durch datenbasiertes Incident Management, KPI-gestützte Analyse mit Power BI und gezielte Maßnahmenplanung im Backlog
• Verankerung von Monitoring- und Observability-Anforderungen (z. B. Logging, Dashboards, Metriken) als Bestandteil der Definition of Done in enger Zusammenarbeit mit DevOps- und Betriebsteams
• Schnittstellenfunktion zwischen Stakeholdern und Dev(Sec)Ops-/SRE-Teams zur gemeinsamen Definition, Priorisierung undKommunikation technischer Zuverlässigkeitsziele im laufenden Produktentwicklungsprozess
• Anbindung an bestehende Systemlandschaften (u. a. ERP, Portale)
• Förderung agiler Skalierungsstrategien (SAFe)
• Durchführung vonWorkshops zur Abstimmung von Stakeholder-Anforderungen und Erstellung von Lösungsvorschlagsunterlagen für technische Integrationen
Anforderungsspezifikationen, Product Owner, Softwareanforderungsanalyse, Stakeholder-Analyse
Geschäftsdaten
Qualifikationen
Projekt‐ & Berufserfahrung
1/2025 – offen
Tätigkeitsbeschreibung
Erstellen eines Releasekonzepts basierend auf den Praktiken von Site Reliability Engineering, zur Unterstützung und Einhaltung von Infrastruktur Vorgaben und SLA.
- Releases
- Observability
- Monitoring
- Rollback
- Automatisierung
- NIS2 Vorgaben
- Auditierfähigkeit
Definitionf Major und Minor Releasestrategien unter Berücksichtung von best-practices wie - Sunset Mode, und Expand-Migrate-Contract
IT-Infrastrukturspezialist, Konzeption (IT), Manager IT-Infrastruktur, Release-Management, Schnittstellenentwicklung, Server-Monitoring
11/2024 – offen
Tätigkeitsbeschreibung
Enable engineering teams to adopt platform thinking and reliability engineering practices (SRE), moving beyond traditional DevOps approaches
• Design and embed reliable release management processes aligned with auditability, traceability, and controlled delivery
• Drive Security by Design principles across the software lifecycle, ensuring early integration of security requirements
• Implement Shift-Left strategies to move testing, validation, and quality assurance into early development phases
• Establish and coach teams on service reliability practices (SLIs/SLOs, error budgets, incident response)
• Reduce operational complexity and manual effort through automation and standardized delivery pipelines
• Support organizations in balancing delivery speed with system stability and regulatory requirements
IT-Infrastrukturspezialist, Manager IT-Infrastruktur, Server-Monitoring, Sicherheitsmanagement
9/2023 – 11/2024
Tätigkeitsbeschreibung
• Einführung eines Incident-Management-Prozesses sowie Aufbau von Governance-Strukturen für
KPIs, SLOs und SLAs.
• Coaching von Teams zur Einführung von DevOps Prinzipien;
• Automatisierung von manueller Deployments und Einführung Release at will
(Azure DevOps, GitLab CI/CD, Kubernetes, Terraform).
• Einführung einer End-to-End Send-service-Plattform für
Entwickler.
• Umsetzung im Einklang mit ISO/IEC 27001 und KRITIS-Vorgaben; Verzahnung von Sicherheits- und
Compliance-Anforderungen mit Cloud-nativen Architekturen.
Machine Learning, Product Information Management
8/2022 – 11/2023
Tätigkeitsbeschreibung
- Leitung der Entwicklung von drei Services einer SaaS-Plattform für die öffentliche Verwaltung mit einem dedizierten SRE-Ansatz zur Sicherstellung von Service-Stabilität
• Verantwortung für SRE-relevante Themen wie Service-Stabilität, Monitoring und Incident Management, integriert in die Produktverantwortung, mit Einführung von Service Level Objectives (SLOs) zur Priorisierung technischer Anforderungen
• Reduktion der durchschnittlichen Incident-Zeit um 60% (von durchschnittlich 48 auf ca. 19 Stunden) durch datenbasiertes Incident Management, KPI-gestützte Analyse mit Power BI und gezielte Maßnahmenplanung im Backlog
• Verankerung von Monitoring- und Observability-Anforderungen (z. B. Logging, Dashboards, Metriken) als Bestandteil der Definition of Done in enger Zusammenarbeit mit DevOps- und Betriebsteams
• Schnittstellenfunktion zwischen Stakeholdern und Dev(Sec)Ops-/SRE-Teams zur gemeinsamen Definition, Priorisierung undKommunikation technischer Zuverlässigkeitsziele im laufenden Produktentwicklungsprozess
• Anbindung an bestehende Systemlandschaften (u. a. ERP, Portale)
• Förderung agiler Skalierungsstrategien (SAFe)
• Durchführung vonWorkshops zur Abstimmung von Stakeholder-Anforderungen und Erstellung von Lösungsvorschlagsunterlagen für technische Integrationen
Anforderungsspezifikationen, Product Owner, Softwareanforderungsanalyse, Stakeholder-Analyse
11/2021 – 8/2022
Tätigkeitsbeschreibung
Einführung und Leitung eines cross-funktionalen Scrum-Teams; Coaching von Product Ownern und
Entwicklern.
• Unterstützung der agilen Transformation durch Etablierung von PI-Planning und SAFe-Events.
• Verzahnung agiler Entwicklung mit bestehenden AMS-Prozessen (Jira, Confluence, Azure DevOps,
SAP-Backend).
Agile Methodologie, Product-lifecycle-cost-management (PLCM), Product Owner
11/2021 – 6/2022
Tätigkeitsbeschreibung
• Unterstützung bei der Einführung agiler Methoden und PI-Planning in einem Konzernumfeld.
• Coaching eines Release Train Engineers (RTE) und Begleitung der Transformation auf Programmebene.
• Schnittstelle zwischen Entwicklung, Betrieb und Serviceprozessen mit Fokus auf Release- und
Change-Management.
Agile Methodologie, PMO (IT), Scrum-Master
1/2020 – 12/2021
Tätigkeitsbeschreibung
• Planung und Steuerung von Backlogs und Releases über Azure DevOps.
• Zusammenarbeit mit Entwicklung und Betrieb in einer Microservices-Umgebung (Java/Kotlin).
• Enge Abstimmung mit Fachbereichen zur Einführung neuer digitaler Services.
Product Owner
1/2019 – 12/2019
Tätigkeitsbeschreibung
• Steuerung von Roadmaps und Releases sowie Koordination interdisziplinärer Teams.
• Aufbau und Pflege von CI/CD-Pipelines (Azure DevOps, Docker/Kubernetes) für eine stabile Servicebereitstellung.
• Verantwortung für Feature-Backlog, Priorisierung und Stakeholder-Kommunikation.
Agile Methodologie, Anforderungsspezifikationen, Product-lifecycle-cost-management (PLCM), Product Owner, Scrum, Softwareanforderungsanalyse
1/2016 – 12/2018
Tätigkeitsbeschreibung
• Coaching eines Scrum-Teams
• Förderung von Selbstorganisation
Agile Methodologie, Scrum-Master, Workflows
7/2012 – 12/2015
Tätigkeitsbeschreibung
• Unterstützung bei internationalen Entwicklungsprojekten
• Koordination von Partnerorganisationen
Projektadministrator, Wertanalyse
Zertifikate
TüV
Devops Institut
Devops Institut
Google Cloud
Ausbildung
Fernuniversität Hagen
Hagen
Über mich
Senior IT-Spezialist mit über 15 Jahren Erfahrung in ITSM-Governance, Release Management, Incident Management und Site Reliability Engineering – aktuell als SRE Governance Lead & Release Manager im NOOTS-Programm bei Dataport AöR, davor u.a. bei 50Hertz Transmission (KRITIS-Infrastruktur), Volkswagen AG und Würth Gruppe. Als akkreditierter Trainer (PeopleCert/DevOps Institute ATO, Registry ID: 9368) bilde ich Teams in SRE Foundation, SRE Practitioner und AIOps Foundation aus.
Kernkompetenzen: ITSM Process Ownership, Incident & Major Incident Management, Change & CAB Governance, Problem & RCA Management, SRE / SLOs / Fehlerbudgets, Observability (Prometheus, Grafana, ELK), Platform Operations (Kubernetes, Helm, ArgoCD, Terraform), Release Management, Stakeholder-Kommunikation, kontinuierliche Serviceverbesserung.
Meine Haltung: SRE wurde bei Google entwickelt und ist seit über 20 Jahren in der Praxis bewiesen – SLOs, Error Budgets, Toil-Reduktion sind keine Theorie, sondern operative Realität. Nicht DevOps und nicht ITIL haben Observability erfunden – das war Google, im Rahmen von SRE. AIOps dagegen ist 2016 von Gartner als Analysten-Begriff geprägt worden – eine Marktkategorie, kein erprobtes Framework. Wenn ITIL 5 beides unter einem Label verkauft, wird ein bewiesenes Engineering-Prinzip mit einem Marketing-Konstrukt gleichgesetzt.
Ich bin in meiner Umsetzung und Hingabe präzise – aber ich verkaufe damit funktionierendes, modernes Werkzeug, keinen Etikettenschwindel.
@alle Recruiter: Bitte beratet eure Firmen. Wenn sie ungelernte, undurchdachte Anforderungen stellen ("wir suchen ITIL 5 Expert*in"), sollten wir ihnen diese Dummheit nicht einfach weiterverkaufen, nur weil es sich gut liest. Fragt nach, was tatsächlich gebraucht wird – Prozess-Governance, SRE-Praxis oder ML-gestütztes Monitoring sind drei verschiedene Dinge.
Weitere Kenntnisse
- AIOps
- ITIL 4 Foundation-Prozessverständnis (Incident, Problem, Change, Request Fulfillment)
- End-to-End Incident-Lifecycle-Management: Erkennung, Triage, Eskalation, Wiederherstellung
- Major-Incident-Prozess-Ownership: Bridge-Call-Koordination, Incident Commander, Communications Lead
- Root-Cause-Analysis (RCA) und Post-Incident-Reviews (PIR): 5-Why, Fishbone, Timeline-Rekonstruktion
- Change-Advisory-Board (CAB) Moderation und Risikoklassifizierung
- Governance-Frameworks für destruktive Changes: Datenbankmigrationen, Infrastruktur-Umbauten
- SLA/OLA-Definition, -Monitoring und Eskalationsmanagement
- Service Level Objectives (SLOs) und Service Level Indicators (SLIs)
- Error-Budget-Konzepte zur Priorisierung Feature vs. Stabilität
- Toil-Reduktion und Automatisierung wiederkehrender operativer Aufgaben
- Observability-Stack-Aufbau: Metriken, Logs, Traces integriert
- Prometheus & Grafana: Metrik-Erfassung, Dashboard-Design, Alerting
- ELK-Stack (Elasticsearch, Logstash, Kibana) für Log-Management
- Kubernetes: Governance-Perspektive, Deployment-Strategien, Readiness-/Liveness-Probes
- Helm-Charts für standardisierte, wiederholbare Deployments
- ArgoCD und GitOps-Prinzipien: deklarative Infrastruktur, Drift-Erkennung
- Terraform/OpenTofu: Infrastructure-as-Code-Governance
- CI/CD-Pipelines: Azure DevOps, GitLab CI, Jenkins
- Release-Zyklus-Konzeption für Multi-Team-Umgebungen (16 Teams koordiniert)
- "Release at Will"-Reifegradmodell in hochregulierten KRITIS-Umgebungen
- Deployment-Pipeline-Governance mit Readiness Gates
- KPI-Dashboards mit Power BI für datenbasiertes Servicemanagement
- MTTR-Reduktion um 60 % durch datengetriebene Maßnahmenplanung
- Stakeholder-Management: Teams, Fachbereiche, Management, externe Partner
- Schnittstelle zwischen Entwicklung, Betrieb und Serviceprozessen
- SAFe 5 Agilist, PI-Planning-Moderation, Release-Train-Engineer-Coaching
- Scrum@Scale und LeSS (Large-Scale Scrum) Praktiker
- Kanban System Design (KSD) und Kanban Systems Improvement (KSI)
- Coaching von Product Ownern, Scrum Mastern, Entwicklungsteams
- Aufbau und Betrieb eines akkreditierten Trainingsunternehmens (PeopleCert/DevOps Institute ATO)
- Curriculum-Entwicklung: SRE Foundation, SRE Practitioner, AIOps Foundation
- Qualitätsmanagement nach ISO 9001, Kap. 7.5
- IT-Sicherheitsbeauftragter (TÜV Rheinland): Awareness und Prozessintegration
- Regulatorische Rahmenwerke: NIS2, KRITIS, ISO 27001
- Change-Governance über kritische Energiemanagementsysteme (50Hertz)
- Microservices-Umgebungen (Java/Kotlin) aus Governance-Perspektive
- Internationale Produktverantwortung: digitale Fahrzeug- und Connectivity-Services (Renault, Daimler)
- Backlog-Management und Sprint-Planung zweisprachig (Deutsch/Englisch)
- Cloud-Plattform-Awareness: AWS, Azure, Hybrid-Cloud
- ServiceNow und Jira Service Management, inkl. Confluence-Prozessdokumentation
- KI-Kompetenz: AI Product Manager Certificate (ProductHQ), AI for Leaders (BabsonX/edX)
- Konzeptioneller Unterschied SRE (Engineering) vs. AIOps (Marktkategorie)
- Alerting- und Response-Rahmenwerke für DevOps-Teams gegen Alert-Fatigue
- Observability als fester Bestandteil der Definition of Done
- Wirtschaftswissenschaftlicher Hintergrund (M.Sc., FernUniversität Hagen)
- Geschäftsführungserfahrung: operative und strategische Unternehmenssteuerung (OPSinnovate UG)
- Zweisprachige Kommunikation Deutsch/Arabisch, Englisch C1
Persönliche Daten
- Deutsch (Muttersprache)
- Englisch (Fließend)
- Europäische Union
Kontaktdaten
Nur registrierte PREMIUM-Mitglieder von freelance.de können Kontaktdaten einsehen.
Jetzt Mitglied werden
