FeedMender/Erreurs/Encodage
Refus fréquents
Encoding problem in attribute
Un défaut d'encodage abîme tous les champs à la fois, et c'est pourquoi Merchant Center le signale sur des attributs qui semblent parfaitement innocents dans votre éditeur. Le défaut tient à la façon dont le fichier a été écrit, pas aux données.
Ce que Google exige
Un fichier encodé de façon cohérente, idéalement en UTF-8
Google lit l'UTF-8, l'UTF-16 et le Latin-1, mais le fichier doit s'en tenir à l'un d'eux de façon cohérente, et ce qu'il déclare doit correspondre à ce qu'il est. Le mode d'échec classique : un fichier exporté en Latin-1, retraité en UTF-8 quelque part dans le pipeline, si bien que chaque caractère accentué, chaque e avec accent aigu dans un nom de produit français, arrive en mojibake ou en caractère de remplacement.
Ce qui se passe si vous ne le faites pas
Des titres et des descriptions corrompus, ou un fichier impossible à parser
Une corruption légère se voit dans des produits dont les titres visibles contiennent des caractères parasites, que les acheteurs voient. Une corruption sévère casse le parsing : les lignes se décalent, les guillemets ne se referment jamais, et l'import écarte des produits sans que personne n'ait décidé de les retirer. Un byte order mark collé à la première cellule d'en-tête est le cas particulier qui rend la première colonne impossible à mettre en correspondance alors que tout le reste semble en ordre.
Comment corriger à la main
Corrigez l'export, vérifiez les octets
- Réglez l'export sur UTF-8 sans BOM et empêchez chaque étape du pipeline, FTP, scripts, tableurs, de réencoder le fichier.
- Vérifiez les octets réels plutôt que le rendu : un fichier peut s'afficher correctement dans un éditeur qui devine généreusement et échouer quand même face à un parseur strict.
- Si les accents sont déjà doublement abîmés, réexportez depuis la source plutôt que de réparer le texte à la main.
Lesquels de nos contrôles s'appliquent
7 contrôles s'appliquent, lus depuis le registre du scanner
La porte d'import décode le fichier comme le ferait un parseur strict et nomme ce qu'elle a trouvé : l'encodage utilisé, un BOM retiré, des caractères de remplacement déjà incrustés. Les lignes impossibles à parser sont comptées et nommées, jamais écartées en silence.
encoding_not_utf8remarqueencoding_bom_removedremarqueencoding_replacement_charsà risqueencoding_binaryarrête l'analyseheader_control_charsà risquequote_unclosedà risquerow_wrong_widthà risque
Le chemin le plus rapide
Laissez l'analyse les trouver
L'analyse lit votre fichier octet par octet avant tout le reste, et vous dit si l'encodage survivra au parseur de Google. L'analyse qui identifie les erreurs est gratuite et montre chaque résultat avant que vous ne payiez quoi que ce soit. Vous ne payez que pour la correction.