هل تحتل التطبيقات ذات التقييم 4.8 نجوم مراكز أعلى؟ حللنا 1,000 بحث في متجر التطبيقات

تذكر Apple التقييمات كمدخل للترتيب، لذا تتبع الأسطورة: احصل على 4.8 وسترتفع. أخذنا 1,000 مجموعة نتائج، و18,796 نتيجة بحث فردية، ونظرنا. قيمة النجوم لا تفسر شيئًا تقريبًا. عدد التقييمات يفسر ست مرات أكثر.

لماذا يستحق السؤال طرحه بشكل صحيح

تذكر Apple أن نتائج البحث تستند إلى “text relevance (matches for your app’s title, subtitle, keywords, and primary category), as well as user behavior (downloads, ratings and reviews, and more)”. هذه الجملة الوحيدة هي أصل كمية هائلة من النصائح حول ملاحقة متوسط نجوم أعلى، عادةً مع تسمية 4.8 كعتبة مهمة.

لكن “ratings and reviews” غامض في المكان المهم بالضبط. قد يعني قيمة النجوم، أو عدد الأشخاص الذين تركوا واحدًا، أو كليهما. هذه أشياء مختلفة وتتضمن عملًا مختلفًا تمامًا: رفع المتوسط مشكلة منتج، ورفع العدد مشكلة توزيع.

الطريقة

نجمع نتائج البحث اليومية للمصطلحات التي يتتبعها عملاؤنا. لهذه الدراسة أخذنا كل مصطلح ودولة مميزين رآهما الجامع في الأيام السبعة حتى 12 سبتمبر 2026، كل منهما محسوب مرة واحدة في أحدث ملاحظة له، وأبقينا مجموعات النتائج حيث كان لدى ثمانية على الأقل من أعلى 20 تطبيقات قيمة نجوم وعدد تقييمات في الملف. هذا يعطي 1,000 مجموعات نتائج و18,796 نتيجة بحث فردية.

أخذ كل مصطلح مرة واحدة مهم. نفس البحث في أيام متتالية يعيد تقريبًا نفس التطبيقات بنفس الترتيب تقريبًا، لذا عده مرتين سيضاعف العينة دون إضافة أي معلومات وسيجعل كل رقم يبدو أكثر يقينًا مما هو عليه.

الصورة الخام: شبه مسطحة

هناك تدرج، وهو ضئيل. النطاق الأعلى تقييمًا ليس النطاق الأفضل تموضعًا: 4.5-4.7 يتفوق عليه. تحت 4.5 الفرق نحو مركز واحد من عشرين، والمجموعة تحت-3.0 توضع أفضل من مجموعة 3.0-3.9، وهذا نوع الانعكاس الذي تراه عندما يكون التأثير غالبًا ضجيجًا.

الرقم السالب يعني أن القيمة الأعلى تقع أقرب إلى المركز الأول. كلاهما كذلك، والعدد أكبر بنحو ست مرات من الإشارة الأقوى. لا شيء كبير: حتى العدد يفسر نسبة قليلة فقط من مكان التطبيق، وهذا تذكير مفيد بأن الصلة، وليس الشعبية، هي التي تقوم بمعظم العمل في نتيجة البحث.

العامل المربك، وماذا يحدث عند إزالته

النجوم وأعداد التقييمات تسافر معًا، لذا المقارنة الخام لا يمكنها فصلهما. في عينتنا نطاق 4.5-4.7 لديه متوسط 13,507 تقييم ونطاق 3.0-3.9 لديه 72. مقارنة هاتين المجموعتين هي غالبًا مقارنة تطبيقات كبيرة مع صغيرة.

لذا قسمنا نفس المواضع إلى نطاقات عدد تقييمات متشابهة ونظرنا إلى تأثير النجوم داخل كل نطاق، حيث يتم تثبيت العامل المربك إلى حد كبير.

اقرأ عمودًا لأسفل وتأثير الحجم واضح: نفس نطاق النجوم ينتقل من حوالي المركز 12 إلى حوالي المركز 9 مع نمو عدد التقييمات. اقرأ عبر صف وتأثير النجوم صغير وغير متسق وفي أصغر نطاق يعمل بالعكس — التطبيقات المقيّمة 4.8-5.0 مع أقل من 200 تقييم جلست الأدنى من أي مجموعة في الجدول.

هذا الانعكاس ليس غامضًا. متوسط 4.9 من 30 مراجعة ينتمي عادةً إلى تطبيق صغير جدًا، وكونه صغيرًا جدًا هو ما يظهر في المركز. إنه عرض نظيف لسبب عدم قراءة التدرج الخام كتأثير نجوم.

اختبار أنظف: قارن داخل مجموعة نتائج واحدة

مقارنة مصطلح مالي بمصطلح لعبة ألغاز تقارن مجموعتين مختلفتين. مقارنة الثلاثة الأوائل ضد المراكز 8-20 من نفس البحث لا تفعل ذلك. أجرينا هذا الاختبار المزدوج على 990 مجموعات النتائج مع تطبيقات مسجلة كافية في كلا الطرفين.

التطبيقات في أعلى مجموعة نتائج مقيّمة 0.023 نجوم أعلى من التطبيقات في أسفلها. لديها نحو تسعة أضعاف عدد التقييمات. المجموعة الأعلى تقييمًا احتلت الثلاثة الأوائل في 52.6% من المجموعات والأسفل في 22.8%، لذا الاتجاه حقيقي — الحجم هو المهمل.

ماذا تقول الأدبيات

هذا ليس سؤالًا جديدًا أكاديميًا، والعمل المنشور يصل إلى مكان مشابه. Sällberg, Wang and Numminen، يكتبون في Journal of Marketing Analytics في 2022، تتبعوا 341 تطبيقًا يوميًا لنحو عامين من إطلاقهم في App Store وفصلوا معلومات التقييم عن نص المراجعة. لتطبيقات الإنتاجية يذكرون أن متوسط درجة التقييم لم يكن له تأثير مباشر كبير على التنزيلات، بينما كان لحجم التقييمات تأثير. لتطبيقات الألعاب كان تأثير الحجم سلبيًا، وهذا بحد ذاته تحذير من معاملة أي من هذه كأذرع بسيطة.

العمل على الأصول المرئية يشير إلى نفس الاتجاه حول حدود التفكير بمتغير واحد: Wang and Li، في Electronic Commerce Research في 2016، استخرجوا ميزات اللون والتعقيد والتناظر من أيقونات Android ووجدوا علاقات قابلة للقياس مع سلوك التنزيل. المجال الأوسع لتنقيب متجر التطبيقات افتتح مع Harman, Jia and Zhang في MSR 2012، الذي أثبت أن بيانات المتجر الوصفية يمكن تحليلها على نطاق واسع أصلًا.

ماذا يعني هذا لقائمتك

حدود هذه الدراسة

أسبوع واحد، iOS فقط، والمصطلحات 3,564 التي يتابعها جامعنا، والتي تميل نحو الفئات التي يعمل فيها عملاؤنا بدلاً من عينة عشوائية من App Store. عدد التقييمات وكيل لقاعدة التثبيت وهو مشوش، لأن التطبيقات تطلب بمعدلات مختلفة جدًا. المركز ملاحظة: لا يمكننا عشوائية متوسط نجوم التطبيق، لذا لا شيء هنا تقدير سببي. وارتباط بهذا الصغر سيغمره أي تأثير فئة لم ننمذجه.

ما ينجو من تلك الحدود هو المقارنة بين إشارتين مقاستين بنفس الطريقة على نفس البيانات. أي انحياز في عينتنا ينطبق على كليهما، والعدد لا يزال يتفوق على قيمة النجوم بنحو ستة إلى واحد.

ابحث عن كلمة رئيسية مجانًا

ابحث عن كلمة رئيسية مجانًا

AsoTheory، كيف تعمل النتائج

ذات صلة

المدونة · دراسات الحالة · Free ASO tools · المنتجات · الخصوصية والشروط · AsoTheory