Dane QC: źródła, zasady liczenia i ograniczenia
Każda liczba na naszych stronach QC jest obliczana z katalogu według stałych reguł. Ta strona dokumentuje te reguły — czym jest rekord, jak deduplikujemy, skąd pochodzą daty i czego dane nie są w stanie powiedzieć — abyś mógł ocenić nasze statystyki, zamiast musieć im wierzyć.
Skąd pochodzą zdjęcia
Zdjęcia QC na QCRadar to zdjęcia z inspekcji wykonane w magazynach agentów, gdy prawdziwe zamówienie trafiło do kontroli. Agregujemy je z protokołów inspekcji wielu platform agentów i nigdy celowo nie usuwamy oznaczeń magazynu: oryginalny znak wodny, wydrukowaną datę i kod QR, jeśli platforma go drukuje. Publiczne kopie mają w rogu mały znak hostingowy QCRadar z QR strony — oznacza on kopię, którą hostujemy i dystrybuujemy, i nie jest dowodem pochodzenia z magazynu. Nigdy nie wypełniamy galerii podobnymi zdjęciami tego samego modelu.
Zdjęcia przesłane przez zalogowanych kupujących pojawiają się po weryfikacji w galeriach produktów oznaczone jako zgłoszenia użytkowników i są liczone osobno w naszych statystykach.
Co liczy się jako jedno zdjęcie QC
Jedno zdjęcie QC = jeden plik graficzny z zapisu inspekcji. Pojedyncza inspekcja daje zwykle kilka zdjęć (ujęcia, pomiary, wady), więc liczby zdjęć są wyższe niż liczby zamówień. Filmy nie są wliczane do liczby zdjęć. Duplikaty plików są odrzucane przy imporcie na podstawie hasha obrazu, więc dwukrotne otrzymanie tego samego pliku nigdy nie zawyża żadnej liczby.
Jak grupowane są produkty i warianty
Zdjęcia są przechowywane per oferta źródłowa (platforma + ID przedmiotu) — to, co nazywamy SPU. Warianty kolorystyczne tej samej oferty dzielą tę pulę, a każde zdjęcie jest przypisywane do swojego wariantu na podstawie etykiety koloru na zapisie inspekcji. Wszystkie statystyki zbiorcze deduplikują na poziomie SPU: oferta z dwunastoma kolorami liczy się raz, a nie dwanaście razy. Gdy ten sam produkt oferuje kilku sprzedawców, odznaki na kartach pokazują licznik najlepiej udokumentowanego sprzedawcy.
Jak obliczane są liczby indeksu
Łączna liczba zdjęć QC = wszystkie zdjęcia z inspekcji w katalogu. „Produkty z QC” i pokrycie katalogu liczą aktywne produkty, których SPU ma co najmniej jedno zdjęcie. Rankingi kategorii i marek sumują liczniki zdeduplikowane na poziomie SPU; produkt z kolaboracji liczy się raz dla każdej marki członkowskiej. Wszystkie liczby indeksu są przeliczane jako codzienny snapshot — data „dane z” na stronie to moment wykonania snapshotu.
Skąd pochodzą daty
Daty inspekcji są parsowane z samego zapisu inspekcji — ze ścieżki lub nazwy pliku nadanej przez magazyn. Gdy daty nie da się sparsować, nie pokazujemy nic: nigdy nie podstawiamy naszego czasu importu jako daty inspekcji, bo czas importu odzwierciedla nasz harmonogram crawlowania, a nie aktywność rynku. Listy „niedawno sprawdzone” sortują według tych sparsowanych dat.
Jedna uwaga o zakresie: ściana „niedawno sprawdzonych” na stronie QC rankuje świeże daty inspekcji w obrębie popularnej puli katalogu, a nie wśród wszystkich produktów, które śledzimy. Liczby indeksu nad nią obejmują cały katalog.
Czego celowo nie publikujemy
Nie rankujemy platform agentów według wolumenu QC. Nasze liczniki per platforma odzwierciedlają to, jak głęboko integrujemy się z danym źródłem, a nie to, jak popularna jest platforma — publikowanie tego jako rankingu rynkowego byłoby mylące, więc tego nie robimy.
Jak weryfikujemy, czy strona z QC jest prawdziwa
Strony z QC w tym hobby śledzimy od lat. Ocena, czy strona naprawdę posiada dane QC, nie wymaga wierzenia jej stronie głównej — i nigdy nie należy oceniać po wystawce, którą sama wybrała do pokazania. Bezpośredni test wygląda tak: weź losowy link do prawdziwego produktu z Weidian, Taobao lub 1688, wklej go do wyszukiwarki QC tej strony i sprawdź, czy zwraca pasujący produkt, pasujący sklep i możliwy do prześledzenia zapis inspekcji.
Prawdziwy rekord QC tworzy łańcuch, który można zaudytować: wyświetlany produkt zgadza się z końcowym linkiem źródłowym, zdjęcia zachowują możliwe do zidentyfikowania źródło inspekcji, widoczna jest data lub szczegóły inspekcji, a ten sam SKU gromadzi kolejne datowane batche wraz z napływem prawdziwych zamówień. Nie każdy agent drukuje na zdjęciu kod QR, wagę i wymiary — ale strona, która nie przyjmie losowego linku i nie potrafi wskazać, do którego produktu, którego sklepu i której inspekcji należy zdjęcie, to galeria obrazków QC, a nie weryfikowalna wyszukiwarka QC.
Każdy może to odtworzyć: nie wyszukuj wyłącznie przedmiotów, które strona promuje — przetestuj garść prawdziwych linków z różnych sklepów i platform i zaudytuj każdy wynik względem jego końcowego linku źródłowego. Po latach ponownego sprawdzania popularnych stron branży te, które niezawodnie przechodzą test, okazują się rzadkością.
Jak klasyfikujemy to, co znajdziemy
- Weryfikowalna wyszukiwarka QC—Losowe linki się rozwiązują; produkt, sklep i link źródłowy się zgadzają; zdjęcia lub zapisy są możliwe do prześledzenia.
- Galeria obrazków QC—Pokazuje zdjęcia QC, ale nie przyjmuje dowolnego linku albo nie potrafi udowodnić, skąd pochodzą jej zdjęcia.
- Niewiarygodne dopasowanie—Wyświetlany produkt nie zgadza się z końcowym produktem źródłowym, sklepem lub ID przedmiotu.
- Reklamowane, ale niedziałające—Deklaruje wyszukiwarkę QC, ale żadne działające wyszukiwanie nie istnieje.
- Potwierdzona niezgodność—To samo zdjęcie w sposób możliwy do udowodnienia obsługuje różne produkty albo strona jawnie przeczy własnemu linkowi źródłowemu.
„Nieweryfikowalne” nie oznacza automatycznie „sfabrykowane” — oznacza, że strona nie potrafi udowodnić własnego twierdzenia. Mocniejszych werdyktów używamy tylko wtedy, gdy niezgodność produktu, sklepu lub linku jest bezpośrednio obserwowalna.
Znane ograniczenia
- Pokrycie różni się w zależności od źródła: niektóre platformy produkują setki zdjęć na produkt, inne garść. Liczby bezwzględne są porównywalne wewnątrz katalogu, a nie w skali całego rynku.
- Nie każde zdjęcie ma nadrukowaną datę lub kod QR; te kontrole mają zastosowanie tam, gdzie platforma je drukuje.
- Liczone są tylko aktywne produkty katalogu; zarchiwizowane oferty i ich zdjęcia znikają ze statystyk.
- Sortowanie po świeżości zależy od dat możliwych do sparsowania: prawdziwe zdjęcie bez takiej daty jest wliczane do sum, ale wykluczone z „niedawno sprawdzonych”.