4.1 Problem Management – Ziele, Begriffe und Abgrenzung

Kurz erklärt

Problem Management beschäftigt sich mit den Ursachen von Incidents.

Während Incident Management vor allem den Service schnell wiederherstellen soll, untersucht Problem Management, warum Incidents entstehen und wie Wiederholungen vermieden werden können.

Ziel ist nicht nur die schnelle Reparatur, sondern eine nachhaltige Verbesserung der Servicequalität.


Warum Problem Management wichtig ist

Viele Störungen treten nicht nur einmal auf.

Beispiele:

Wenn solche Fälle nur einzeln gelöst werden, bleibt die eigentliche Ursache bestehen.

Problem Management hilft dabei:


Incident und Problem unterscheiden

Incident Problem
ungeplante Unterbrechung oder Qualitätsminderung eines Service Ursache oder mögliche Ursache eines oder mehrerer Incidents
Fokus auf schnelle Wiederherstellung Fokus auf Ursachenverständnis und Vermeidung
kurzfristige Bearbeitung häufig längerfristige Analyse
Workaround kann ausreichen dauerhafte Lösung wird angestrebt
Ziel: Service wieder nutzbar machen Ziel: Wiederholung verhindern oder Auswirkungen reduzieren

Beispiel:

Incident

Benutzer können sich nicht am VPN anmelden.

Problem

Die Ursache liegt in einer fehlerhaften Zertifikatsverteilung, die regelmäßig zu abgelaufenen Client-Zertifikaten führt.


Problem Management ist nicht nur Fehlerbehebung

Problem Management bedeutet nicht nur:

Jemand sucht den technischen Fehler.

Es umfasst auch:

Ein Problem kann auch dann angelegt werden, wenn noch keine endgültige Ursache bekannt ist.


Problem, Known Error und Workaround unterscheiden

Begriff Bedeutung
Problem Ursache oder mögliche Ursache eines oder mehrerer Incidents
Known Error Problem mit bekannter Ursache oder bekanntem Fehlerzustand
Workaround vorübergehende Möglichkeit, Auswirkungen zu umgehen oder zu reduzieren
dauerhafte Lösung Maßnahme, die die Ursache beseitigt oder das Risiko nachhaltig reduziert

Beispiel:

Problem

Mehrere Clients verlieren nach dem Ruhezustand die VPN-Verbindung.

Known Error

Bestimmte Client-Version verursacht nach dem Ruhezustand fehlerhafte Tunnelzustände.

Workaround

VPN-Client vollständig beenden und neu starten.

Dauerhafte Lösung

Client-Version aktualisieren oder Konfiguration ändern.


Problem Management und Incident Management arbeiten zusammen

Incident Management liefert wichtige Informationen für Problem Management.

Dazu gehören:

Problem Management liefert zurück:

Dadurch werden zukünftige Incidents schneller lösbar oder vollständig vermieden.


Reaktives Problem Management

Reaktives Problem Management beginnt nach Incidents.

Auslöser können sein:

Beispiel:

Nach einem Major Incident wird untersucht, warum ein zentraler Dienst ausgefallen ist und warum Monitoring nicht früher gewarnt hat.


Proaktives Problem Management

Proaktives Problem Management sucht nach Problemen, bevor größere Incidents entstehen.

Informationsquellen können sein:

Beispiel:

Monitoring zeigt, dass Speicherplatz auf mehreren Servern regelmäßig kritisch wird.

Noch ist kein Ausfall eingetreten.

Problem Management kann trotzdem prüfen, warum Kapazitätsplanung, Alarmierung oder Bereinigung nicht ausreichen.


Typische Auslöser für einen Problem Record

Ein Problem Record kann sinnvoll sein, wenn:

Nicht jeder einzelne Incident benötigt automatisch einen Problem Record.


Problem Record

Ein Problem Record dokumentiert die Bearbeitung eines Problems.

Typische Inhalte:

Das konkrete Format hängt vom verwendeten ITSM-System und der Organisation ab.


Priorisierung von Problems

Problems sollten priorisiert werden.

Kriterien können sein:

Ein Problem mit wenigen Incidents kann trotzdem hohe Priorität besitzen, wenn es einen kritischen Service oder ein hohes Sicherheitsrisiko betrifft.


Problem Management und Change Enablement

Dauerhafte Lösungen erfordern häufig Änderungen.

Beispiele:

Solche Maßnahmen sollten nicht unkontrolliert umgesetzt werden.

Sie müssen entsprechend Risiko, Auswirkung und Organisationsregeln über Change Enablement gesteuert werden.


Problem Management und Knowledge Management

Problem Management erzeugt wertvolles Wissen.

Dieses Wissen sollte nutzbar gemacht werden für:

Beispiele:

Wissen darf nicht nur im Kopf einzelner Spezialisten bleiben.


Problem Management und Service Configuration Management

Für Ursachenanalysen sind Service- und CI-Informationen wichtig.

Hilfreich sind:

Ohne diese Informationen wird Ursachenanalyse oft langsam und ungenau.

Beispiel:

Mehrere Anwendungen fallen aus.

Erst durch die CI-Beziehungen wird erkennbar, dass alle vom gleichen Datenbankcluster abhängig sind.


Problem Management und Continual Improvement

Problem Management ist eng mit kontinuierlicher Verbesserung verbunden.

Aus Problems können entstehen:

Ein gelöstes Problem sollte deshalb nicht nur abgeschlossen werden.

Es sollte geprüft werden, welche Erkenntnisse für zukünftige Arbeit nutzbar sind.


Problem Management und Risiko

Nicht jede Ursache kann sofort beseitigt werden.

Manchmal ist eine dauerhafte Lösung:

Dann muss das verbleibende Risiko bewusst bewertet und dokumentiert werden.

Mögliche Maßnahmen:


Workaround als wichtiger Zwischenschritt

Ein Workaround ist keine endgültige Lösung, kann aber sehr wertvoll sein.

Er hilft dabei:

Ein Workaround sollte dokumentiert werden mit:


Dauerhafte Lösung

Eine dauerhafte Lösung soll die Ursache beseitigen oder das Risiko wesentlich reduzieren.

Beispiele:

Nicht jede dauerhafte Lösung ist rein technisch.

Auch Prozesse, Kommunikation und Verantwortlichkeiten können Ursachen sein.


Technische Ursache und organisatorische Ursache

Ein Problem kann mehrere Ursachenebenen besitzen.

Beispiel:

Ein Zertifikat läuft ab.

Technische Ursache

Zertifikat ist nicht mehr gültig.

Organisatorische Ursache

Es gab keinen verantwortlichen Owner für Zertifikatsüberwachung.

Prozessursache

Es gab keinen geregelten Ablauf für rechtzeitige Erneuerung.

Verbesserung

Monitoring, Verantwortlichkeit und Erneuerungsprozess werden eingeführt.

Merke

Die technische Ursache ist oft nur ein Teil der Gesamtursache.


Problem Management ist keine Schuldsuche

Problem Management soll nicht klären, wer schuld ist.

Ziel ist:

Eine Schuldzuweisung führt häufig dazu, dass Informationen zurückgehalten werden.

Eine lernorientierte Analyse führt zu besseren Ergebnissen.


Praxisbeispiel: Wiederkehrende VPN-Störungen

Ausgangslage

Mehrere Benutzer melden regelmäßig VPN-Abbrüche.

Incident Management stellt den Zugang jeweils durch Neustart des Clients wieder her.

Problem Management

Die Incidents werden gemeinsam ausgewertet.

Auffällig ist:

Ergebnis

Ein Known Error wird dokumentiert.

Ein Workaround wird für den Service Desk bereitgestellt.

Ein Change zur Aktualisierung des VPN-Clients wird geplant.


Praxisbeispiel: Druckerwarteschlange blockiert

Ausgangslage

Ein Etikettendrucker im Versand blockiert mehrfach pro Woche.

Incident Management entfernt jeweils den fehlerhaften Druckauftrag.

Problem Management

Die Analyse zeigt:

Dauerhafte Lösung

Treiber wird getestet und über Change Enablement aktualisiert.

Zusätzlich wird ein Knowledge-Artikel für den Service Desk erstellt.


Praxisbeispiel: Speicher läuft voll

Ausgangslage

Ein Server erzeugt regelmäßig Incidents wegen vollem Speicher.

Incident Management löscht temporäre Dateien.

Problem Management

Die Untersuchung zeigt:

Verbesserung


Typische Fehler

Fehler 1

Jeder Incident wird einzeln bearbeitet, ohne Muster zu erkennen.


Fehler 2

Problem Management wird erst nach sehr großen Störungen genutzt.


Fehler 3

Workarounds werden nicht dokumentiert.


Fehler 4

Known Errors bleiben nur einzelnen Spezialisten bekannt.


Fehler 5

Die technische Ursache wird gefunden, aber organisatorische Ursachen werden ignoriert.


Fehler 6

Dauerhafte Lösungen werden ohne Change-Bewertung umgesetzt.


Fehler 7

Problems werden eröffnet, aber nicht aktiv verfolgt.


Fehler 8

Priorisierung fehlt.


Fehler 9

Problem Management wird als Schuldsuche verstanden.


Fehler 10

Lessons Learned werden nicht in Knowledge, Monitoring oder Prozesse übernommen.


Checkliste Problem erfassen


Checkliste Problem bearbeiten


Checkliste Problem abschließen


Bedeutung für Fachinformatiker für Systemintegration

Fachinformatiker für Systemintegration liefern häufig die wichtigsten technischen Informationen für Problem Management.

Dazu gehören:

Wichtig ist nicht nur, einen Incident schnell zu beheben.

Wichtig ist auch, wiederkehrende Ursachen zu erkennen und die Umgebung dauerhaft stabiler zu machen.


Zusammenfassung

Incidents treten auf

Muster oder schwere Auswirkungen werden erkannt

Problem Record wird erstellt

Ursache oder mögliche Ursache wird untersucht

Workaround wird dokumentiert

Known Error wird bei Bedarf erfasst

dauerhafte Lösung wird geplant

Change, Knowledge und Improvement werden eingebunden

zukünftige Incidents werden reduziert oder schneller lösbar


Merksätze

Incident Management stellt den Service wieder her.

Problem Management versteht und reduziert Ursachen.

Ein Workaround ist hilfreich, aber keine dauerhafte Lösung.

Ein Known Error muss nutzbar dokumentiert sein.

Problem Management ist Lernen, nicht Schuldsuche.

Gute Problem Records machen Services langfristig stabiler.


Verwandte Seiten


Quellen und Versionsstand

Offizielle Grundlagen

Einordnung

Die dargestellten:

sind herstellerneutrale Praxisempfehlungen.

ITIL schreibt keine universelle:

für alle Organisationen vor.

Die konkrete Umsetzung muss an:

angepasst werden.

Behandelter Framework-Stand: ITIL Version 5
Zusätzlich berücksichtigt: aktuelle ITIL-4-Practice-Guidance
Fachlicher Stand: August 2026


Revision #1
Created 2 August 2026 14:56:40 by Admin
Updated 2 August 2026 14:56:54 by Admin