Jak dane są przechowywane i wyświetlane

Próbkowanie danych – informacje

Czym jest próbkowanie danych

Próbkowanie danych to metoda analizy podzbioru danych, która służy do odkrywania cennych informacji o większym zbiorze danych. Umożliwia ona szybsze pobieranie danych przy minimalnym wpływie na ich jakość.

Jeśli np. chcesz oszacować liczbę drzew na obszarze 100 akrów, na którym ich zagęszczenie jest dosyć równomierne, możesz policzyć drzewa na powierzchni 1 akra, a potem przemnożyć uzyskaną wartość przez 100, lub policzyć drzewa na powierzchni 0,5 akra, a następnie przemnożyć uzyskaną wartość przez 200, aby otrzymać dobre przybliżenie liczebności drzew na całym 100-akrowym obszarze.

Dlaczego występuje próbkowanie danych

W Google Analytics próbkowanie danych może wystąpić, gdy liczba zdarzeń użytych do utworzenia raportu, eksploracji lub żądania przekracza limit obowiązujący w przypadku Twojej usługi. Analytics używa wtedy części danych, a potem przeskalowuje wyniki, aby uzyskać statystyki o dużej przybliżonej dokładności, które odzwierciedlają wszystkie dane.

Jeśli wyniki zostały uzyskane za pomocą próbkowania, jest to sygnalizowane przez ikonę jakości danych, której towarzyszy wartość procentowa danych użytych do wygenerowania wyników. Im większy rozmiar próbki, tym dokładniejsze wyniki.

Ile wynoszą limity

Limit zapytań na poziomie zdarzenia to 10 mln zdarzeń w przypadku standardowych usług w Google Analytics i maksymalnie 1 mld zdarzeń w przypadku usług w Google Analytics 360.

W usługach w Google Analytics 360 początkowo obowiązuje ustawienie domyślne 100 mln zdarzeń na zapytanie, co pozwala szybciej wyświetlać wyniki o dużej przybliżonej dokładności. Jeśli wymagana jest większa precyzja, za pomocą ikony jakości danych możesz uzyskać dostęp do wyższego limitu próbkowania w sekcji Eksplorowanie. Musisz tylko wybrać opcję „Bardziej szczegółowe wyniki”.

Uwaga: filtrowanie dużych zbiorów danych według kraju może spowodować próbkowanie danych w standardowych raportach Google Analytics i w sekcji Eksplorowanie, nawet w przypadku wysyłania próśb o rozwinięte zbiory danych. Dzieje się tak, ponieważ filtrowanie aktywuje inne metody przetwarzania danych, które w przypadku zbiorów danych przekraczających 100 milionów zdarzeń częściej powodują próbkowanie. Aby zminimalizować próbkowanie, w razie potrzeby rozważ zmniejszenie zakresu dat w raportach lub zastosowanie alternatywnych metod analizy.

A co z danymi niespróbkowanymi?

W przypadku niespróbkowanych raportów Google Analytics używa funkcji HyperLogLog++ (HLL++) do oszacowania dokładnych wartości liczbowych poszczególnych najczęściej używanych danych, np. użytkowników i sesji. Korzystanie z HLL++ zapewnia lepszą wydajność, większą dokładność szacowania i niższe granice błędu. HLL++ możesz też używać z danymi Google Analytics w BigQuery. Więcej informacji o przybliżonej liczbie unikalnych użytkowników w Google Analytics.

Uwaga: w większości przypadków rozbieżności są mniejsze niż 1%, ale mogą być większe, zwłaszcza przy łączeniu więcej niż jednego rodzaju danych HLL++. Google Analytics używa szkicu HLL++ 14. Dowiedz się więcej o szkicach HLL++.
Ta strona może zawierać treści przetłumaczone przy użyciu technologii AI. Tłumaczenia wygenerowane przez AI mogą zawierać błędy.

Czy to było pomocne?

Jak możemy ją poprawić?
Szukaj
Wyczyść wyszukiwanie
Zamknij wyszukiwanie
Aplikacje Google
Menu główne
932361729431489598
true
Wyszukaj w Centrum pomocy
false
true
true
true
true
true
69256
false
false
false
false
false