Magasabbra rangsorolnak a 4,8 csillagos értékelésű alkalmazások? 1000 App Store keresést elemeztünk

Az Apple az értékeléseket rangsorolási bemenetként nevezi meg, így a folklór következik: érd el a 4,8-at, és feljebb kerülsz. Vettünk 1000 találati halmazt, 18 796 egyedi keresési találatot, és megnéztük. A csillagérték szinte semmit sem magyaráz. Az értékelések száma hatszor többet magyaráz.

Miért érdemes a kérdést rendesen feltenni

Az Apple azt állítja, hogy a keresési találatok a(z) “text relevance (matches for your app’s title, subtitle, keywords, and primary category), as well as user behavior (downloads, ratings and reviews, and more)” alapján készülnek. Ez az egyetlen mondat az eredete annak a rengeteg tanácsnak, amely a magasabb csillagátlag hajszolásáról szól, általában a(z) 4.8-t nevezve meg a számító küszöbnek.

De a(z) “ratings and reviews” pontosan ott kétértelmű, ahol számít. Jelentheti a csillagértéket, vagy azok számát, akik hagytak egyet, vagy mindkettőt. Ezek különböző dolgok, és teljesen más munkát jelentenek: az átlag emelése termékprobléma, a darabszám emelése terjesztési probléma.

Módszer

Naponta gyűjtjük a keresési találatokat az ügyfeleink által követett kifejezésekre. Ehhez a tanulmányhoz vettünk minden különböző kifejezést és országot, amelyet a gyűjtő a(z) 12 szeptember 2026-ig tartó hét napban látott, mindegyiket egyszer számolva a legutóbbi megfigyelésénél, és megtartottuk azokat a találati halmazokat, ahol a top 20 appok közül legalább nyolcnak volt csillagértéke és értékelésszáma is nyilvántartva. Ez 1,000 találati halmazt és 18,796 egyedi keresési találatot ad.

Minden kifejezés egyszeri figyelembevétele számít. Ugyanaz a keresés egymást követő napokon majdnem ugyanazokat az appokat adja majdnem ugyanabban a sorrendben, így kétszeri számolása megduplázná a mintát anélkül, hogy bármilyen információt hozzáadna, és minden számot biztosabbnak tüntetne fel, mint amilyen.

A nyers kép: majdnem lapos

Van egy gradiens, és apró. A legjobbra értékelt sáv nem a legjobban elhelyezkedő sáv: a(z) 4.5-4.7 megelőzi. A(z) 4.5 alatt a különbség körülbelül egy pozíció a húszból, és a(z) 3.0 alatti csoport jobban helyezkedik el, mint a(z) 3.0-3.9 csoport, ami olyan megfordulás, amit akkor látsz, ha egy hatás többnyire zaj.

A negatív szám azt jelenti, hogy a magasabb érték közelebb ül az első helyhez. Mindkettő így van, és a darabszám nagyjából hatszorosa az erősebb jelnek. Egyik sem nagy: még a darabszám is csak néhány százalékát magyarázza annak, hol ül egy app, ami hasznos emlékeztető, hogy a relevancia, nem a népszerűség végzi a munka nagy részét egy keresési találatban.

A zavaró tényező, és mi történik, ha eltávolítod

A csillagok és az értékelésszámok együtt mozognak, így a nyers összehasonlítás nem tudja szétválasztani őket. A mintánkban a(z) 4.5-4.7 sáv mediánja 13,507 értékelés, a(z) 3.0-3.9 sávé 72. E két csoport összehasonlítása többnyire nagy appok összehasonlítása kicsikkel.

Ezért ugyanazokat az elhelyezéseket hasonló értékelésszámú sávokra osztottuk, és megnéztük a csillaghatást minden sávon belül, ahol a zavaró tényező nagyrészt mozdulatlan.

Olvass le egy oszlopot, és a skála hatása nyilvánvaló: ugyanaz a csillagsáv körülbelül a(z) 12 pozícióról körülbelül a(z) 9 pozícióra mozog, ahogy az értékelésszám nő. Olvass végig egy sort, és a csillaghatás kicsi, következetlen, és a legkisebb sávban visszafelé fut — a(z) 4.8-5.0 értékelésű appok 200 értékelés alatt a táblázat bármely csoportjánál legalacsonyabban ültek.

Ez a megfordulás nem titokzatos. Egy 4.9 átlag 30 értékelésből általában egy nagyon kicsi apphoz tartozik, és a nagyon kicsiség az, ami megjelenik a pozícióban. Ez tiszta demonstrációja annak, miért nem szabad a nyers gradienst csillaghatásként olvasni.

Tisztább teszt: hasonlíts össze egyetlen találati halmazon belül

Egy pénzügyi kifejezés összehasonlítása egy puzzle-játék kifejezéssel két különböző populációt hasonlít össze. A top három összehasonlítása ugyanazon keresés 8-20 pozícióival nem. Ezt a páros tesztet futtattuk le a(z) 990 találati halmazon, ahol mindkét végén volt elég pontozott app.

A találati halmaz tetején lévő appok 0.023 csillaggal magasabbra vannak értékelve, mint az alján lévők. Körülbelül kilencszer annyi értékelésük van. A magasabbra értékelt csoport a halmazok 52.6%-ában tartotta a top hármat, és 22.8%-ában az alját, tehát az irány valós — a méret az, ami elhanyagolható.

Amit a szakirodalom mond

Ez tudományosan nem új kérdés, és a publikált munka hasonló helyre jut. Sällberg, Wang és Numminen, a Journal of Marketing Analytics-ben írva 2022-ben, 341 appot követett naponta körülbelül két évig az App Store-beli megjelenésüktől, és elválasztotta az értékelési információt a véleményszövegtől. A termelékenységi appoknál azt jelentik, hogy az átlagos értékelési pontszámnak nincs szignifikáns közvetlen hatása a letöltésekre, míg az értékelések mennyiségének van. A játékappoknál a mennyiségi hatás negatív volt, ami maga is figyelmeztetés arra, hogy ezeket ne kezeld egyszerű karokként.

A vizuális eszközökről szóló munka ugyanabba az irányba mutat az egyváltozós gondolkodás korlátairól: Wang és Li, az Electronic Commerce Research-ben 2016-ben, színt, komplexitást és szimmetriajellemzőket vont ki Android ikonokból, és mérhető kapcsolatokat talált a letöltési viselkedéssel. Az app store bányászat tágabb területe Harman, Jia és Zhang munkájával nyílt meg az MSR 2012-ben, amely megállapította, hogy a bolt metaadatai egyáltalán elemezhetők nagy léptékben.

Mit jelent ez a listázásodra nézve

A tanulmány korlátai

Egy hét, csak iOS, és a(z) 3,564 kifejezések, amelyeket a gyűjtőnk követ, amelyek inkább az ügyfeleink által lefedett kategóriák felé hajlanak, nem pedig az App Store véletlenszerű mintája. Az értékelésszám a telepítőbázis proxyja, és zajos, mivel az appok nagyon eltérő arányban kérnek értékelést. A pozíció megfigyeléses: nem tudjuk randomizálni egy app csillagátlagát, így itt semmi sem okozati becslés. És egy ilyen kicsi korrelációt elnyomna bármilyen kategóriahatás, amit nem modelleztünk.

Ami túléli ezeket a korlátokat, az a két jel összehasonlítása, amelyeket ugyanúgy mértek ugyanazon az adaton. Bármilyen torzítás ül a mintánkban, mindkettőre vonatkozik, és a darabszám még mindig körülbelül hatszorosan felülmúlja a csillagértéket.

Keress egy kulcsszót ingyen

Keress egy kulcsszót ingyen

AsoTheory, hogyan működnek a pontszámok

Kapcsolódó

Blog · Esettanulmányok · Free ASO tools · Termékek · Adatvédelem és feltételek · AsoTheory