FeedMender

FeedMender/Errori/Codifica dei caratteri

Rifiuti frequenti

Encoding problem in attribute

Un difetto di codifica danneggia tutti i campi insieme, ed è per questo che Merchant Center lo segnala su attributi che nel tuo editor sembrano perfettamente innocenti. Il difetto sta nel modo in cui il file è stato scritto, non nei dati.

Analizza il tuo feed gratis

Cosa richiede Google

Un file codificato in modo coerente, idealmente UTF-8

Google legge UTF-8, UTF-16 e Latin-1, ma il file deve essere uno di questi in modo coerente, e ciò che dichiara deve corrispondere a ciò che è. Il caso tipico è un file esportato come Latin-1 e rielaborato come UTF-8 da qualche parte nella pipeline, così ogni carattere accentato, ogni e con l'accento acuto in un nome di prodotto francese, arriva come mojibake o come carattere sostitutivo.

Cosa succede se non lo fai

Titoli e descrizioni corrotti, o un file che il parser non accetta

La corruzione lieve si mostra come prodotti con caratteri spazzatura nei titoli visibili, che gli acquirenti vedono. La corruzione grave rompe il parsing: le righe slittano, le virgolette non si chiudono mai e l'importazione perde prodotti senza che nessuno abbia deciso di rimuoverli. Un byte order mark incollato alla prima cella dell'intestazione è il caso speciale che rende impossibile mappare la prima colonna mentre tutto il resto sembra a posto.

Come risolverlo a mano

Correggi l'esportazione, verifica i byte

  • Imposta l'esportazione su UTF-8 senza BOM e impedisci a ogni passaggio della pipeline, FTP, script, fogli di calcolo, di ricodificare il file.
  • Controlla i byte reali invece della resa a schermo: un file può apparire corretto in un editor che indovina con generosità e fallire comunque con un parser rigoroso.
  • Se gli accenti sono già doppiamente danneggiati, riesporta dall'origine invece di riparare il testo a mano.

Quali dei nostri controlli si applicano

7 controlli si applicano, letti dal registro dello scanner

Il gate di importazione decodifica il file come farebbe un parser rigoroso e dà un nome a ciò che trova: la codifica usata, un BOM rimosso, caratteri sostitutivi già impressi nel file. Le righe che non si possono interpretare vengono contate e nominate, mai scartate in silenzio.

  • encoding_not_utf8nota
  • encoding_bom_removednota
  • encoding_replacement_charsa rischio
  • encoding_binaryferma l'analisi
  • header_control_charsa rischio
  • quote_uncloseda rischio
  • row_wrong_widtha rischio

La via più rapida

Lascia che l'analisi li trovi

L'analisi legge il tuo file byte per byte prima di chiunque altro e ti dice se la codifica sopravviverà al parser di Google. L'analisi che individua gli errori è gratuita e mostra ogni risultato prima che tu paghi qualcosa. Paghi solo per la correzione.

Analizza il feed