Die Quelle vor der Umwandlung sichern
Dieser Workflow bereitet Text für ein anderes System vor und ersetzt nicht stillschweigend den Originaldatensatz. Speichern Sie die Quelle und ein Beispiel mit dem konkreten Problem: unlesbare Zeichen, Vollbreiten-Satzzeichen, gemischte Datumsformen, Währungssymbole oder MIME-Escape-Sequenzen. Legen Sie Zielzeichensatz, Breite, Gebietsschema und Ausgabeformat fest.
Zuerst die Darstellungsschichten reparieren
Bei E-Mail-Transfertext verwenden Sie quoted-printable-decoder, bevor Sie Zeichen interpretieren. Liegen die Dateibytes in einem anderen Zeichensatz vor, folgt file-encoding-converter; das Zwischenergebnis bleibt erhalten. So werden Escape-Sequenzen oder Mojibake nicht mit echtem Inhalt verwechselt.
Wählen Sie mit fullwidth-to-halfwidth oder halfwidth-to-fullwidth genau eine Richtung. Die erste passt oft zu Bezeichnern und ASCII-Feldern, die zweite zu einer CJK-Satzkonvention. Prüfen Sie neben Buchstaben auch Satzzeichen und Ziffern.
Bedeutungstragende Werte gezielt normalisieren
Wenn die Darstellung stabil ist, verwenden Sie text-date-format-unifier für ein festgelegtes Datumsformat und text-currency-normalizer für Beträge mit bekanntem Code und bekannter Regel. Bewahren Sie den alten Wert und protokollieren Sie die Änderung: Eine normalisierte Währungszeichenkette ist keine finanzielle Freigabe.
Schließen Sie mit dem passenden Zielpfad ab. advanced-case-converter behandelt Namenskonventionen, number-to-words Fließtext und word-separator zeilenweise Listen. Für MIME wird quoted-printable-encoder erst nach allen Textänderungen eingesetzt. Prüfen Sie Zeichen, Daten, Beträge, Zeilenumbrüche und das Zielformat vor der Übergabe.