Czy aplikacje z oceną 4,8 gwiazdek zajmują wyższe pozycje? Przeanalizowaliśmy 1000 wyszukiwań w App Store
Apple wymienia oceny jako czynnik pozycjonowania, więc folklor podąża: zdobądź 4,8 i awansujesz. Wzięliśmy 1000 zestawów wyników, 18 796 pojedynczych wyników wyszukiwania i przyjrzeliśmy się. Wartość gwiazdek wyjaśnia prawie nic. Liczba ocen wyjaśnia sześć razy więcej.
Dlaczego warto zadać to pytanie porządnie
Apple stwierdza, że wyniki wyszukiwania opierają się na “text relevance (matches for your app’s title, subtitle, keywords, and primary category), as well as user behavior (downloads, ratings and reviews, and more)”. To jedno zdanie jest źródłem ogromnej ilości porad dotyczących dążenia do wyższej średniej gwiazdek, zwykle z 4.8 wymienianym jako próg, który ma znaczenie.
Ale “ratings and reviews” jest niejednoznaczne dokładnie w miejscu, które ma znaczenie. Może oznaczać wartość gwiazdek lub liczbę osób, które je zostawiły, lub jedno i drugie. To są różne rzeczy i implikują zupełnie inną pracę: podniesienie średniej to problem produktowy, a podniesienie liczby to problem dystrybucji.
Metoda
Codziennie zbieramy wyniki wyszukiwania dla terminów śledzonych przez naszych klientów. Do tego badania wzięliśmy każdy odrębny termin i kraj, które kolektor widział w ciągu siedmiu dni do 12 września 2026, każdy policzony raz przy najnowszej obserwacji, i zachowaliśmy zestawy wyników, w których co najmniej osiem z top 20 aplikacji miało zarówno wartość gwiazdek, jak i liczbę ocen w pliku. To daje 1,000 zestawów wyników i 18,796 pojedynczych wyników wyszukiwania.
Liczenie każdego terminu raz ma znaczenie. To samo wyszukiwanie w kolejnych dniach zwraca prawie te same aplikacje w prawie tej samej kolejności, więc policzenie go dwa razy podwoiłoby próbę bez dodawania żadnych informacji i sprawiłoby, że każda liczba wyglądałaby na bardziej pewną, niż jest.
Surowy obraz: prawie płaski
Jest gradient i jest on malutki. Najlepiej oceniane pasmo nie jest najlepiej plasowanym pasmem: 4.5-4.7 je wyprzedza. Poniżej 4.5 różnica wynosi około jednej pozycji na dwadzieścia, a grupa poniżej 3.0 plasuje się lepiej niż grupa 3.0-3.9, co jest rodzajem inwersji, którą widzisz, gdy efekt jest głównie szumem.
Liczba ujemna oznacza, że wyższa wartość znajduje się bliżej pozycji pierwszej. Obie tak robią, a liczba jest około sześciokrotnie silniejszym sygnałem. Żadna nie jest duża: nawet liczba wyjaśnia tylko kilka procent tego, gdzie znajduje się aplikacja, co jest przydatnym przypomnieniem, że trafność, a nie popularność, wykonuje większość pracy w wynikach wyszukiwania.
Czynnik zakłócający i co się dzieje, gdy go usuniesz
Gwiazdki i liczba ocen idą razem, więc surowe porównanie nie może ich rozdzielić. W naszej próbie pasmo 4.5-4.7 ma medianę 13,507 ocen, a pasmo 3.0-3.9 ma 72. Porównanie tych dwóch grup to głównie porównanie dużych aplikacji z małymi.
Więc podzieliliśmy te same pozycje na pasma o podobnej liczbie ocen i przyjrzeliśmy się efektowi gwiazdek w każdym paśmie, gdzie czynnik zakłócający jest w dużej mierze utrzymany na stałym poziomie.
Czytając kolumnę, efekt skali jest oczywisty: to samo pasmo gwiazdek przesuwa się z około pozycji 12 na około pozycję 9 w miarę wzrostu liczby ocen. Czytając wiersz, efekt gwiazdek jest mały, niespójny, a w najmniejszym paśmie działa odwrotnie — aplikacje ocenione na 4.8-5.0 z mniej niż 200 ocenami znajdowały się najniżej ze wszystkich grup w tabeli.
Ta inwersja nie jest tajemnicza. Średnia 4.9 z 30 recenzji zwykle należy do bardzo małej aplikacji, a bycie bardzo małym jest tym, co pojawia się w pozycji. To czysta demonstracja, dlaczego surowego gradientu nie należy odczytywać jako efektu gwiazdek.
Czystszy test: porównanie w obrębie jednego zestawu wyników
Porównanie terminu finansowego z terminem gry logicznej porównuje dwie różne populacje. Porównanie trzech najlepszych z pozycjami 8-20 tego samego wyszukiwania nie. Przeprowadziliśmy ten sparowany test na 990 zestawach wyników z wystarczającą liczbą ocenionych aplikacji na obu końcach.
Aplikacje na szczycie zestawu wyników są ocenione o 0.023 gwiazdek wyżej niż aplikacje na dole. Mają około dziewięć razy więcej ocen. Grupa z wyższą oceną zajmowała pierwszą trójkę w 52.6% zestawów, a dolną w 22.8%, więc kierunek jest prawdziwy — to rozmiar jest znikomy.
Co mówi literatura
To nie jest nowe pytanie akademicko, a opublikowane prace lądują w podobnym miejscu. Sällberg, Wang i Numminen, pisząc w Journal of Marketing Analytics w 2022, śledzili 341 aplikacji codziennie przez około dwa lata od premiery w App Store i oddzielili informacje o ocenach od tekstu recenzji. Dla aplikacji produktywnościowych podają, że średnia ocena nie miała istotnego bezpośredniego wpływu na pobrania, podczas gdy wolumen ocen miał. Dla aplikacji gamingowych efekt wolumenu był negatywny, co samo w sobie jest ostrzeżeniem przed traktowaniem któregokolwiek z tych czynników jako prostych dźwigni.
Prace nad zasobami wizualnymi wskazują ten sam kierunek co do ograniczeń myślenia jednowymiarowego: Wang i Li, w Electronic Commerce Research w 2016, wyodrębnili cechy koloru, złożoności i symetrii z ikon Androida i znaleźli mierzalne związki z zachowaniami pobierania. Szersza dziedzina eksploracji sklepów z aplikacjami rozpoczęła się od Harmana, Jia i Zhanga na MSR 2012, co ustaliło, że metadane sklepowe można analizować na dużą skalę w ogóle.
Co to oznacza dla twojego opisu
Ograniczenia tego badania
Jeden tydzień, tylko iOS i 3,564 terminów, które śledzi nasz kolektor, które skłaniają się ku kategoriom, w których pracują nasi klienci, a nie losowej próbie App Store. Liczba ocen jest wskaźnikiem zastępczym bazy instalacji i to zaszumionym, ponieważ aplikacje proszą o oceny w bardzo różnym tempie. Pozycja jest obserwacyjna: nie możemy randomizować średniej gwiazdek aplikacji, więc nic tutaj nie jest oszacowaniem przyczynowym. A tak mała korelacja zostałaby przytłoczona przez jakikolwiek efekt kategorii, którego nie modelowaliśmy.
To, co przetrwa te ograniczenia, to porównanie dwóch sygnałów mierzonych w ten sam sposób na tych samych danych. Jakiekolwiek obciążenie siedzi w naszej próbie, dotyczy obu, a liczba wciąż przewyższa wartość gwiazdek około sześciokrotnie.
Sprawdź słowo kluczowe za darmo
Sprawdź słowo kluczowe za darmo
AsoTheory, jak działają wyniki
Powiązane
- Darmowy tracker pozycji aplikacji: praktyczny przepływ pracy dla małych zespołów
- Od badania słów kluczowych do testu listy
- alternatywy data.ai dla niezależnych deweloperów
- Niestandardowe strony produktów mogą teraz zdobywać organiczny ruch z wyszukiwania w App Store. Większość deweloperów tego nie włączyła
Blog · Studia przypadków · Free ASO tools · Produkty · Prywatność i warunki · AsoTheory