yellow police tape

Bemanding af bridge, styring af eskaleringer og genoprettelse af drift når kritiske systemer er nede.

Jeg træder til når forretningskritiske systemer fejler og der skal styres struktureret gennem en Major Incident — fra første eskalering til genoprettet drift og efterfølgende post-mortem. Rollen er både hands-on teknisk fejlsøgning og koordinering af mange parter under tidspres. Erfaringen dækker samfundskritiske løsninger, globale operationer og 24/7-miljøer hvor nedetid har direkte økonomisk eller sikkerhedsmæssig konsekvens.

Typiske leverancer:

  • Situation Management (24/7) for forretningskritiske systemer — vagtdækning, standby-parathed og hurtig mobilisering ved eskaleringer
  • Håndtering af Major Incidents fra opdagelse til lukning — bemanding af bridge, koordinering af tekniske specialister og løbende kommunikation til ledelse og forretning
  • Hands-on teknisk fejlsøgning i produktionsmiljøer — log-analyse, bash CLI, netværksdiagnostik og systemintegrations-troubleshooting
  • Etablering og modning af Incident- og Problem Management-processer efter ITIL — inkl. severity-modeller, eskaleringsveje og RCA-metodik
  • Forberedelse af operationelt beredskab forud for nye 24/7-driftsmodeller — kortlægning af systemafhængigheder, kontaktflader og teknisk dokumentation
  • Disaster Recovery- og Business Continuity-tests af forretningskritiske løsninger — planlægning, eksekvering og validering
  • Facilitering af Post-Incident Reviews og driving af opfølgende Problem Records — så samme fejl ikke rammer to gange
  • Hyper-care efter go-live — udvidet incident-dækning og eskalerings-support i overgangen fra projekt til stabil drift
  • Teknisk bindeled og SPOC mellem forretning, driftsleverandør og applikationsteams under eskaleringer
  • Kommunikation af tekniske situationer til ikke-tekniske interessenter — situationsrapportering, ETA’er og forretningskonsekvens i klarsprog
Typisk kontekst:
Samfundskritiske løsninger i offentlig sektor (told, politi, transport, medier), globale operationer i private virksomheder samt finans- og forsikringssektor. Miljøer med 24/7-drift, høje krav til oppetid og direkte økonomisk eller sikkerhedsmæssig konsekvens ved nedetid.
Metoder & rammer:
Situation Management (24/7) · Major Incident Management · Incident Management · Problem Management · Root Cause Analysis (RCA) · Post-Incident Review · Disaster Recovery · Business Continuity · Service Desk-opbygning · Operational Readiness · Hyper Care · Eskaleringsstyring · Severity-modeller · Interessentkommunikation · ITIL · ITSM
Platforme & teknologier:
SAP · Oracle · Java · .NET · Egenudviklede løsninger (in-house) · COTS · SaaS · Azure · AWS · VMware · Kubernetes · Linux (Bash CLI, log-analyse) · Windows Server · Mainframe (z/OS) · Unix (AIX/HP-UX) · Netværk · Firewall · Storage · Backup · BizTalk · API (REST/SOAP)
Værktøjer:
ServiceNow · BMC Remedy · Jira · Confluence · AppDynamics