FeedMender

FeedMender/Fouten/Codering

Veelvoorkomende afkeuringen

Encoding problem in attribute

Een coderingsfout beschadigt elk veld tegelijk, en daarom rapporteert Merchant Center hem op attributen die er in je editor volkomen onschuldig uitzien. De fout zit in hoe het bestand is weggeschreven, niet in de data.

Scan je feed gratis

Wat Google vereist

Een consistent gecodeerd bestand, bij voorkeur UTF-8

Google leest UTF-8, UTF-16 en Latin-1, maar het bestand moet consequent één daarvan zijn, en wat het declareert moet kloppen met wat het is. De klassieke fout is een bestand dat als Latin-1 is geëxporteerd en ergens in de pipeline als UTF-8 opnieuw is verwerkt, zodat elk geaccentueerd teken, elke e met accent aigu in een Franse productnaam, aankomt als mojibake of als het vervangingsteken.

Wat er gebeurt als je het niet doet

Verhaspelde titels en beschrijvingen, of een bestand dat niet parst

Milde beschadiging toont zich als producten met rommeltekens in hun zichtbare titels, die shoppers te zien krijgen. Ernstige beschadiging breekt het parsen: rijen verschuiven, aanhalingstekens sluiten nooit, en de import laat producten vallen zonder dat iemand besloot ze te verwijderen. Een byte order mark die aan de eerste kopcel vastgeplakt zit is het speciale geval dat de eerste kolom ontoewijsbaar maakt terwijl al het andere er goed uitziet.

Zo los je het handmatig op

Herstel de export, verifieer de bytes

  • Zet de export op UTF-8 zonder BOM en zorg dat geen enkele stap in de pipeline, FTP, scripts, spreadsheets, het bestand opnieuw codeert.
  • Controleer de werkelijke bytes in plaats van de weergave: een bestand kan er prima uitzien in een editor die gul gokt en toch falen bij een strikte parser.
  • Zijn accenten al dubbel beschadigd, exporteer dan opnieuw vanuit de bron in plaats van tekst handmatig te repareren.

Welke van onze controles van toepassing zijn

7 controles zijn van toepassing, afgelezen uit het register van de scanner

De importpoort decodeert het bestand zoals een strikte parser dat doet en benoemt wat ze aantrof: de gebruikte codering, een verwijderde BOM, vervangingstekens die er al in gebakken zitten. Rijen die niet te parsen zijn worden geteld en benoemd, nooit stilletjes weggelaten.

  • encoding_not_utf8opmerking
  • encoding_bom_removedopmerking
  • encoding_replacement_charsloopt risico
  • encoding_binarystopt de scan
  • header_control_charsloopt risico
  • quote_unclosedloopt risico
  • row_wrong_widthloopt risico

De snellere weg

Laat de scan ze vinden

De scan leest je bestand byte voor byte voordat iets anders dat doet, en vertelt je of de codering Googles parser gaat overleven. De scan die fouten opspoort is gratis en toont elke bevinding voordat je iets betaalt. Je betaalt alleen voor het herstel.

Scan je feed