JSON-Formatierer
JSON formatieren, prüfen und minifizieren, mit genauer Fehlerstelle.
Entwicklung
CSV zu JSON und zurück, mit Tabellenansicht und Typerkennung.
Das ist die häufigste Ursache dafür, dass eine CSV-Datei „kaputt" aussieht, und sie hat nichts mit der Datei zu tun.
Das C in CSV steht für Comma. In Ländern mit Dezimalkomma — Deutschland, Österreich, Schweiz, Frankreich, weite Teile Europas — kollidiert das: „1.234,56" enthält bereits ein Komma. Excel löst das, indem es im deutschen Gebietsschema das Listentrennzeichen auf Semikolon setzt.
Eine in deutschem Excel gespeicherte CSV-Datei ist also semikolongetrennt. Ein Parser, der stur an Kommas trennt, zerlegt sie an den Dezimalstellen — das Ergebnis ist nicht offensichtlich falsch, sondern plausibel falsch, und genau deshalb gefährlich.
Dieses Werkzeug prüft die ersten Zeilen auf Komma, Semikolon, Tabulator und Pipe und wählt das Zeichen mit der gleichmäßigsten Spaltenzahl. Bei Bedarf lässt sich das überschreiben.
Der zweite deutsche Klassiker: Aus „Müller" wird „Müller" oder „M?ller".
Excel schreibt CSV-Dateien unter Windows historisch in Windows-1252, nicht in UTF-8. Wer sie in einem Editor oder Skript als UTF-8 liest, bekommt Zeichensalat bei allen Umlauten und beim ß.
Umgekehrt genauso: Eine saubere UTF-8-Datei zeigt in Excel kaputte Umlaute, wenn keine Byte-Order-Mark am Anfang steht. Excel nutzt die BOM als Signal, dass es sich um UTF-8 handelt.
Praktisch heißt das: Für den Weg nach Excel eine BOM voranstellen. Für den Weg aus Excel in ein Skript entweder „CSV UTF-8" als Format wählen oder die Kodierung beim Einlesen ausdrücklich auf Windows-1252 setzen.
CSV kennt keine Typen — alles ist Text. Die Typerkennung rät, ob eine Spalte Zahlen, Wahrheitswerte oder Text enthält, und das geht bei deutschen Daten öfter schief als anderswo.
Drei Fälle, in denen Raten schadet: Führende Nullen bei Postleitzahlen — aus 01067 wird 1067. Lange Zahlen wie IBANs oder Artikelnummern, die in wissenschaftliche Notation kippen. Und Datumsangaben im Format 03.04.2026, die je nach Interpretation zum 3. April oder zum 4. März werden.
Für Kennungen, Postleitzahlen und Kontonummern ist die Typerkennung abzuschalten. Sie helfen nur, wenn die Spalte wirklich gerechnet wird.
Weil deutsches Excel das Komma als Dezimaltrennzeichen braucht und deshalb Semikolon als Listentrennzeichen verwendet.
Eine Kodierungsfrage. Excel schreibt unter Windows meist Windows-1252; als UTF-8 gelesen ergibt das Zeichensalat.
Mit Byte-Order-Mark speichern, oder in Excel über „Daten importieren" die Kodierung ausdrücklich wählen.
Durch die Typerkennung, die sie als Zahl liest. Schalte sie für diese Spalte ab.
Ja. Bei verschachtelten Objekten werden die Pfade zu Spaltennamen zusammengesetzt.
Nein. Das Einlesen läuft in diesem Tab.