Warum eine CSV in Excel seltsame Zeichen zeigt
Die Kodierungsverwechslung hinter zerschossenen Umlauten, und drei Wege, sie zu beheben.
Sie öffnen eine CSV in Excel, und Namen wie Müller oder José erscheinen mit seltsamen Symbolen statt der Umlaute und Akzente. Auch Eurozeichen und Apostrophe werden zu Knäueln merkwürdiger Zeichen. Mit Ihren Daten ist alles in Ordnung. Excel liest die Datei nur mit der falschen Zeichenkodierung.
Was dahintersteckt
Eine Textdatei besteht nur aus Bytes, und eine Kodierung ist die Regel, nach der daraus Buchstaben werden. Fast jedes moderne System schreibt CSV-Dateien in UTF-8, das jede Sprache abdeckt. Excel unter Windows geht beim Doppelklick auf eine CSV aber immer noch von einer älteren regionalen Kodierung wie Windows-1252 aus, es sei denn, die Datei beginnt mit einer kleinen Markierung, der Byte-Reihenfolge-Markierung oder BOM. Ohne BOM wird jedes Zeichen außerhalb des einfachen Englisch nach der falschen Regel dekodiert, und jeder Umlaut erscheint als zwei oder drei Müllzeichen.
Die Daten sind intakt. Öffnen Sie dieselbe Datei in Google Sheets, Numbers oder einem Texteditor, sieht sie einwandfrei aus.
Lösung 1: den BOM hinzufügen
Ist die Datei korrektes UTF-8 und zeigt nur Excel sie falsch an, schicken Sie sie mit eingeschalteter BOM-Option durch das Werkzeug zum Reparieren der Kodierung. Die Zeichen bleiben unverändert, aber die Markierung sagt Excel, dass es UTF-8 lesen soll, und die Datei öffnet sich ab dann auch per Doppelklick korrekt.
Lösung 2: in eine echte Excel-Datei umwandeln
Eine .xlsx-Datei kennt keine Mehrdeutigkeit bei der Kodierung. Der Konverter CSV in Excel liest die CSV korrekt und speichert eine Arbeitsmappe, die sich überall richtig öffnet. Außerdem behält er führende Nullen in Postleitzahlen und Telefonnummern, die Excel beim direkten Öffnen einer CSV streicht.
Lösung 3: importieren statt doppelklicken
Nutzen Sie in Excel Daten, Aus Text/CSV, und stellen Sie den Dateiursprung auf 65001: Unicode (UTF-8). Dann liest Excel die Datei richtig. Das funktioniert, aber Sie müssen jedes Mal daran denken, weshalb die ersten beiden Lösungen für Dateien, die Sie weitergeben, praktischer sind.
Wenn die Datei selbst beschädigt ist
Manchmal sind die zerschossenen Zeichen in der Datei gespeichert. Das passiert, wenn jemand eine UTF-8-Datei in Excel geöffnet, das Durcheinander gesehen und sie erneut gespeichert hat. Jetzt sind die Müllzeichen die Daten. Das Problem zeigt sich dann in jedem Programm, nicht nur in Excel. Das Werkzeug zum Reparieren der Kodierung hat genau dafür einen Reparaturmodus: Es macht die doppelte Kodierung rückgängig und stellt die ursprünglichen Buchstaben wieder her. Der automatische Modus erkennt diesen Fall in den meisten Dateien.
Schnelldiagnose
| Was Sie sehen | Wahrscheinliche Ursache | Lösung |
|---|---|---|
| Nur in Excel falsch, anderswo richtig | Fehlender BOM | BOM hinzufügen oder in .xlsx umwandeln |
| In jedem Programm falsch | Datei wurde nach dem Fehllesen gespeichert | Doppelte Kodierung reparieren |
| Fragezeichen oder Kästchen | Datei in einer alten Windows-Kodierung gespeichert | Von Windows-1252 in UTF-8 umwandeln |
Vorbeugen
- Wählen Sie beim Export aus Excel „CSV UTF-8“ statt einfachem CSV.
- Fügen Sie beim Export aus anderen Systemen für Excel-Nutzer einen BOM hinzu, wenn die Option existiert.
- Speichern Sie eine CSV, die zerschossen aussieht, nie erneut. Reparieren Sie zuerst die Kodierung.