An der Grenze normalisieren
Spaltennamen, Kennungen, Leerzeichen, Datumswerte und kategorische Werte sollten beim Eintritt in den Workflow normalisiert werden. Interne Logik sollte nicht wiederholt raten müssen, was ein Feld bedeutet.
Fehlend, ungültig und doppelt trennen
Diese Zustände brauchen unterschiedliche Entscheidungen. Eine fehlende E-Mail kann prüfbar sein; eine ungültige Kontokennung kann Verarbeitung blockieren; ein doppeltes Ereignis kann einen idempotenten No-op benötigen.
Evidenz nicht löschen
Bewahren Sie Originaleingabe, Transformationszusammenfassung und gegebenenfalls Ausgabe abgelehnter Datensätze auf. Rückverfolgbarkeit macht aus Debugging eine kontrollierte Prüfung statt Raten.
Erst dann das Zielsystem verbinden
Wenn die Grenze explizit ist, können API-Retries und Synchronisationslogik sicher entworfen werden. Das Ziel erhält Datensätze mit bekannter Struktur und definierter Ausnahmebehandlung.
Datenbereinigung ist keine kosmetische Vorbereitung. Sie ist Teil der Integrationsarchitektur.

