FeedMender/Fehler/Zeichenkodierung
Häufige Ablehnungen
Encoding problem in attribute
Ein Kodierungsfehler beschädigt alle Felder auf einmal, weshalb Merchant Center ihn gegen Attribute meldet, die in Ihrem Editor völlig unauffällig aussehen. Der Fehler liegt darin, wie die Datei geschrieben wurde, nicht in den Daten.
Was Google verlangt
Eine konsistent kodierte Datei, idealerweise UTF-8
Google liest UTF-8, UTF-16 und Latin-1, aber die Datei muss durchgängig eines davon sein, und was sie deklariert, muss dem entsprechen, was sie ist. Das typische Versagen: eine als Latin-1 exportierte Datei, irgendwo in der Pipeline als UTF-8 weiterverarbeitet, sodass jedes akzentuierte Zeichen, jedes e mit Akut in einem französischen Produktnamen, als Zeichensalat oder als Ersatzzeichen ankommt.
Was passiert, wenn Sie es nicht tun
Verstümmelte Titel und Beschreibungen, oder eine Datei, die sich nicht parsen lässt
Leichte Beschädigung zeigt sich als Produkte mit Müllzeichen in ihren sichtbaren Titeln, die Käufer sehen. Schwere Beschädigung bricht das Parsen: Zeilen verrutschen, Anführungszeichen schließen nie, und der Import verliert Produkte, ohne dass jemand entschieden hätte, sie zu entfernen. Ein Byte Order Mark, das an der ersten Kopfzelle klebt, ist der Sonderfall, der die erste Spalte unzuordenbar macht, während alles andere in Ordnung aussieht.
So beheben Sie es von Hand
Den Export korrigieren, die Bytes verifizieren
- Stellen Sie den Export auf UTF-8 ohne BOM und halten Sie jeden Schritt der Pipeline, FTP, Skripte, Tabellenkalkulationen, davon ab, die Datei neu zu kodieren.
- Prüfen Sie die tatsächlichen Bytes statt der Darstellung: Eine Datei kann in einem großzügig ratenden Editor gut aussehen und trotzdem an einem strengen Parser scheitern.
- Sind Akzente bereits doppelt beschädigt, exportieren Sie neu aus der Quelle, statt Text von Hand zu reparieren.
Welche unserer Prüfungen greifen
7 Prüfungen greifen, abgelesen aus dem Register des Scanners
Das Import-Gate dekodiert die Datei so, wie ein strenger Parser es tut, und benennt, was es gefunden hat: die verwendete Kodierung, ein entferntes BOM, bereits eingebrannte Ersatzzeichen. Zeilen, die sich nicht parsen lassen, werden gezählt und benannt, nie stillschweigend verworfen.
encoding_not_utf8Hinweisencoding_bom_removedHinweisencoding_replacement_charsgefährdetencoding_binarystoppt den Scanheader_control_charsgefährdetquote_unclosedgefährdetrow_wrong_widthgefährdet
Der schnellere Weg
Lassen Sie den Scan sie finden
Der Scan liest Ihre Datei Byte für Byte, bevor irgendetwas anderes es tut, und sagt Ihnen, ob die Kodierung Googles Parser übersteht. Der Scan, der Fehler aufspürt, ist kostenlos und zeigt jedes Ergebnis, bevor Sie etwas zahlen. Sie zahlen nur für die Korrektur.