FeedMender/Błędy/Kodowanie znaków
Częste odrzucenia
Encoding problem in attribute
Błąd kodowania uszkadza wszystkie pola naraz i dlatego Merchant Center zgłasza go przy atrybutach, które w Twoim edytorze wyglądają zupełnie niewinnie. Wina leży w tym, jak plik został zapisany, nie w danych.
Czego wymaga Google
Spójnie zakodowany plik, najlepiej UTF-8
Google czyta UTF-8, UTF-16 i Latin-1, ale plik musi być jednym z nich konsekwentnie, a to, co deklaruje, musi zgadzać się z tym, czym jest. Typowy scenariusz błędu: plik wyeksportowany jako Latin-1, gdzieś w potoku ponownie przetworzony jako UTF-8, przez co każdy znak z akcentem, każde e z kreską we francuskiej nazwie produktu, dociera jako krzaczki albo jako znak zastępczy.
Co się stanie, jeśli tego nie zrobisz
Uszkodzone tytuły i opisy albo plik, którego nie da się sparsować
Łagodne uszkodzenie widać jako produkty ze śmieciowymi znakami w widocznych tytułach, które oglądają kupujący. Poważne uszkodzenie psuje parsowanie: wiersze się przesuwają, cudzysłowy nigdy się nie domykają, a import gubi produkty, choć nikt nie zdecydował o ich usunięciu. Znacznik BOM przyklejony do pierwszej komórki nagłówka to szczególny przypadek, który uniemożliwia zmapowanie pierwszej kolumny, podczas gdy cała reszta wygląda dobrze.
Jak naprawić to ręcznie
Napraw eksport, zweryfikuj bajty
- Ustaw eksport na UTF-8 bez BOM i pilnuj, aby żaden etap potoku, FTP, skrypty, arkusze kalkulacyjne, nie zmieniał kodowania.
- Sprawdzaj rzeczywiste bajty, a nie sposób wyświetlania: plik może wyglądać dobrze w edytorze, który zgaduje hojnie, i mimo to przepaść w rygorystycznym parserze.
- Jeśli znaki z akcentami są już podwójnie uszkodzone, wyeksportuj ponownie ze źródła zamiast naprawiać tekst ręcznie.
Które z naszych kontroli mają zastosowanie
7 kontroli ma zastosowanie, odczytane z rejestru skanera
Brama importu dekoduje plik tak, jak robi to rygorystyczny parser, i nazywa to, co znalazła: użyte kodowanie, usunięty BOM, znaki zastępcze już zapisane w danych. Wiersze, których nie da się sparsować, są liczone i wskazywane, nigdy gubione po cichu.
encoding_not_utf8uwagaencoding_bom_removeduwagaencoding_replacement_charszagrożoneencoding_binaryzatrzymuje analizęheader_control_charszagrożonequote_unclosedzagrożonerow_wrong_widthzagrożone
Szybsza droga
Pozwól analizie je znaleźć
Analiza czyta Twój plik bajt po bajcie, zanim zrobi to cokolwiek innego, i mówi Ci, czy kodowanie przetrwa parser Google. Analiza, która wykrywa błędy, jest bezpłatna i pokazuje każdy wynik, zanim cokolwiek zapłacisz. Płacisz tylko za poprawkę.