FeedMender/Fouten/Codering
Veelvoorkomende afkeuringen
Encoding problem in attribute
Een coderingsfout beschadigt elk veld tegelijk, en daarom rapporteert Merchant Center hem op attributen die er in je editor volkomen onschuldig uitzien. De fout zit in hoe het bestand is weggeschreven, niet in de data.
Wat Google vereist
Een consistent gecodeerd bestand, bij voorkeur UTF-8
Google leest UTF-8, UTF-16 en Latin-1, maar het bestand moet consequent één daarvan zijn, en wat het declareert moet kloppen met wat het is. De klassieke fout is een bestand dat als Latin-1 is geëxporteerd en ergens in de pipeline als UTF-8 opnieuw is verwerkt, zodat elk geaccentueerd teken, elke e met accent aigu in een Franse productnaam, aankomt als mojibake of als het vervangingsteken.
Wat er gebeurt als je het niet doet
Verhaspelde titels en beschrijvingen, of een bestand dat niet parst
Milde beschadiging toont zich als producten met rommeltekens in hun zichtbare titels, die shoppers te zien krijgen. Ernstige beschadiging breekt het parsen: rijen verschuiven, aanhalingstekens sluiten nooit, en de import laat producten vallen zonder dat iemand besloot ze te verwijderen. Een byte order mark die aan de eerste kopcel vastgeplakt zit is het speciale geval dat de eerste kolom ontoewijsbaar maakt terwijl al het andere er goed uitziet.
Zo los je het handmatig op
Herstel de export, verifieer de bytes
- Zet de export op UTF-8 zonder BOM en zorg dat geen enkele stap in de pipeline, FTP, scripts, spreadsheets, het bestand opnieuw codeert.
- Controleer de werkelijke bytes in plaats van de weergave: een bestand kan er prima uitzien in een editor die gul gokt en toch falen bij een strikte parser.
- Zijn accenten al dubbel beschadigd, exporteer dan opnieuw vanuit de bron in plaats van tekst handmatig te repareren.
Welke van onze controles van toepassing zijn
7 controles zijn van toepassing, afgelezen uit het register van de scanner
De importpoort decodeert het bestand zoals een strikte parser dat doet en benoemt wat ze aantrof: de gebruikte codering, een verwijderde BOM, vervangingstekens die er al in gebakken zitten. Rijen die niet te parsen zijn worden geteld en benoemd, nooit stilletjes weggelaten.
encoding_not_utf8opmerkingencoding_bom_removedopmerkingencoding_replacement_charsloopt risicoencoding_binarystopt de scanheader_control_charsloopt risicoquote_unclosedloopt risicorow_wrong_widthloopt risico
De snellere weg
Laat de scan ze vinden
De scan leest je bestand byte voor byte voordat iets anders dat doet, en vertelt je of de codering Googles parser gaat overleven. De scan die fouten opspoort is gratis en toont elke bevinding voordat je iets betaalt. Je betaalt alleen voor het herstel.