FeedMender/Errori/Codifica dei caratteri
Rifiuti frequenti
Encoding problem in attribute
Un difetto di codifica danneggia tutti i campi insieme, ed è per questo che Merchant Center lo segnala su attributi che nel tuo editor sembrano perfettamente innocenti. Il difetto sta nel modo in cui il file è stato scritto, non nei dati.
Cosa richiede Google
Un file codificato in modo coerente, idealmente UTF-8
Google legge UTF-8, UTF-16 e Latin-1, ma il file deve essere uno di questi in modo coerente, e ciò che dichiara deve corrispondere a ciò che è. Il caso tipico è un file esportato come Latin-1 e rielaborato come UTF-8 da qualche parte nella pipeline, così ogni carattere accentato, ogni e con l'accento acuto in un nome di prodotto francese, arriva come mojibake o come carattere sostitutivo.
Cosa succede se non lo fai
Titoli e descrizioni corrotti, o un file che il parser non accetta
La corruzione lieve si mostra come prodotti con caratteri spazzatura nei titoli visibili, che gli acquirenti vedono. La corruzione grave rompe il parsing: le righe slittano, le virgolette non si chiudono mai e l'importazione perde prodotti senza che nessuno abbia deciso di rimuoverli. Un byte order mark incollato alla prima cella dell'intestazione è il caso speciale che rende impossibile mappare la prima colonna mentre tutto il resto sembra a posto.
Come risolverlo a mano
Correggi l'esportazione, verifica i byte
- Imposta l'esportazione su UTF-8 senza BOM e impedisci a ogni passaggio della pipeline, FTP, script, fogli di calcolo, di ricodificare il file.
- Controlla i byte reali invece della resa a schermo: un file può apparire corretto in un editor che indovina con generosità e fallire comunque con un parser rigoroso.
- Se gli accenti sono già doppiamente danneggiati, riesporta dall'origine invece di riparare il testo a mano.
Quali dei nostri controlli si applicano
7 controlli si applicano, letti dal registro dello scanner
Il gate di importazione decodifica il file come farebbe un parser rigoroso e dà un nome a ciò che trova: la codifica usata, un BOM rimosso, caratteri sostitutivi già impressi nel file. Le righe che non si possono interpretare vengono contate e nominate, mai scartate in silenzio.
encoding_not_utf8notaencoding_bom_removednotaencoding_replacement_charsa rischioencoding_binaryferma l'analisiheader_control_charsa rischioquote_uncloseda rischiorow_wrong_widtha rischio
La via più rapida
Lascia che l'analisi li trovi
L'analisi legge il tuo file byte per byte prima di chiunque altro e ti dice se la codifica sopravviverà al parser di Google. L'analisi che individua gli errori è gratuita e mostra ogni risultato prima che tu paghi qualcosa. Paghi solo per la correzione.