09. Fehlerdiagnose, Logging und Wiederanlauf
Unterscheiden Sie Authentifizierung, Berechtigung, Validierung, Konflikt, Rate, Timeout und Serverfehler – und führen Sie jeden Fall in eine passende, fortsetzbare Reaktion.
Der Unterschied zwischen einer Störung von zehn Minuten und einem Suchtag steckt oft in einem einzigen guten Logeintrag.
Die Schnittstelle als Produkt
Fehler brauchen Klassen: 401 verlangt Sitzung, 403 Berechtigung, 4xx meist Datenkorrektur, 409 Konfliktentscheidung und 5xx/Timeout begrenzten technischen Retry. Ein Checkpoint verhindert, dass der gesamte Lauf neu beginnt.
So wird die Anbindung robust
- Vergaben Sie pro Lauf und Vorgang Korrelations- und externe ID.
- Protokollieren Sie Start, Ende, Routeklasse, Status, Dauer, Versuch, Checkpoint und Ergebnis ohne Geheimnisse.
- Klassifizieren Sie Fehler nach dauerhaft, transient, konflikt oder unbekannt.
- Wiederholen Sie nur transiente Fehler begrenzt.
- Verschieben Sie fachliche Fehler in eine Klärungswarteschlange mit verständlicher Ursache.
- Setzen Sie nach Korrektur ab sicherem Checkpoint fort und belegen Sie Vollständigkeit.
Produktionsreife nachweisen
- Ein Ereignis lässt sich systemübergreifend verfolgen.
- Logs sind datensparsam und zugriffsgeschützt.
- Alarm unterscheidet Einzelproblem und Systemstörung.
- Wiederanlauf erzeugt keine Lücke oder Dublette.
Fehler, die erst im Betrieb teuer werden
- Komplette Requests landen im Log und enthalten Geheimnisse.
- Endlos-Retry verdeckt einen dauerhaften Mappingfehler.
- Ein Lauf wird „grün“, obwohl Dead-Letter-Fälle offen bleiben.
Das nehmen Sie mit
Störungen werden zu diagnostizierbaren Arbeitsfällen mit sicherem Rückweg in den Datenstrom.
Weiterführende Themen
- Für Integrationsspezialisten – APIs und externe Systeme anbinden › 02. Anmeldung und Sitzungscookie
- Für Integrationsspezialisten – APIs und externe Systeme anbinden › 05. Filtern, paginieren und große Datenmengen
- Für Integrationsspezialisten – APIs und externe Systeme anbinden › 10. Test, Abnahme und Produktionsbetrieb
Häufige Fragen
**Was soll ein sicherer Logeintrag enthalten?**
Zeit, Umgebung, Integration, Korrelations-ID, Objektart, externe ID oder Hash, Operation, Statusklasse, Dauer, Versuch und neutralen Fehlercode.
**Wann darf automatisch wiederholt werden?**
Bei klar transienten Fehlern wie begrenzten Timeouts oder 5xx – mit Backoff, Jitter, Limit und idempotenter Verarbeitung.