مراجعة الحملة بعد انتهائها: فصل جودة القرار عن الحظ
قالب لمراجعة الحملة بعد انتهائها: حكم الفرضية، وتشريح الفانل، وفصل جودة القرار عن الحظ، وقاعدتان على الأكثر، وسطر في سجل التجارب ترثه الحملة القادمة.
حوّل قائمة الأفكار إلى تجارب قابلة للقياس: فرضية بدليل، ومقياس أساسي ومقاييس حامية، وحجم عينة بافتراضاته، وقاعدة قرار تُكتب قبل البدء لا بعد النتيجة.
التجربة ليست «نجرّب ونشوف». تجربة النمو (Growth experiment) تُكتب قبل أن تبدأ في أربعة أسطر: فرضية تقول ماذا سيتغير ولماذا، ومقياس أساسي واحد تحكم به ومعه مقاييس حامية لا يجوز أن تسوء، وحجم عينة ومدة تكفي لرؤية الأثر الذي يهمك، وقاعدة قرار مكتوبة: ماذا نفعل لو فازت، أو خسرت، أو لم تحسم.
القاعدة المكتوبة قبل البدء هي جوهر الطريقة. بعد رؤية الأرقام يجد كل فريق سببًا ليقرأ النتيجة كما يحب. وإذا راقبت النتيجة كل يوم وأوقفت الاختبار عند أول فرق «مهم»، فأنت ترفع احتمال الفوز الكاذب كثيرًا. في الصفحة أمر (Prompt) يحوّل قائمة أفكارك إلى قائمة تجارب مرتبة، وبطاقة لتصميم تجربة واحدة، وصيغة لسجل التجارب.
اختر مرحلة واحدة من الفانل تحد النمو الآن: جذب الزوار (Acquisition)، أو تفعيلهم (Activation)، أو الاحتفاظ بهم (Retention)، أو تحقيق الإيراد منهم (Monetization). ثم عرّف مقياسها بالبسط والمقام. مثلًا: نسبة الطلب = عدد الطلبات ÷ عدد زوار صفحة المنتج.
كل فكرة لا تمس هذه المرحلة تذهب إلى قائمة انتظار، مهما كانت مثيرة. فكرة «نفتح قناة تيك توك» لا تحل مشكلة أن الزوار الحاليين لا يطلبون.
الصيغة: «نعتقد أن [تغيير محدد] سيرفع [المقياس] من [القيمة الحالية] إلى [القيمة المتوقعة] على الأقل، لأن [دليل]».
الجزء الأهم هو «لأن». الدليل قد يكون أسئلة العملاء على واتساب، أو تعليقات التقييمات، أو تسجيلات الجلسات، أو تجربة سابقة. إن لم يوجد «لأن» صادق، فالفكرة ليست تجربة بعد: ضعها في قائمة «تحتاج بحثًا أولًا».
الفرضية الجيدة تحدد أيضًا أصغر أثر يستحق (Minimum detectable effect)، أي أصغر تحسن يغيّر قرارك لو تحقق. هذا الرقم سيحدد حجم العينة في الخطوة 5.
اختر مقياسًا قريبًا من التغيير نفسه. لو غيّرت سطرًا تحت زر الطلب، فنسبة الطلب أقرب من «الإيراد الشهري».
أشهر طريقتين للترتيب:
الفرق يجمعون الدرجات بطرق مختلفة (متوسط أو ضرب)، وهذا لا يهم كثيرًا. المهم أن تعرف أن الدرجات تقدير شخصي وليست قياسًا. ثلاث قواعد تجعلها أصدق:
حجم العينة يعتمد على ثلاثة أشياء: نسبتك الحالية، وأصغر أثر يستحق، ومستوى الخطأ الذي تقبله. قاعدة تقريبية ذكرها إيفان ميلر لمقياس نسبة (نعم/لا):
عدد الزوار لكل نسخة ≈ 16 × p × (1 − p) ÷ δ²
حيث p النسبة الحالية، وδ الفرق المطلق الذي تريد رؤيته. افتراضاتها: مستوى دلالة 5% (احتمال إعلان فرق غير موجود)، وقوة 80% (احتمال رؤية الأثر لو كان موجودًا فعلًا)، ونسختان، وعينة محددة مسبقًا لا تتغير. مثال: p = 2.5% وتريد رؤية 3.0% (δ = 0.5 نقطة): 16 × 0.025 × 0.975 ÷ 0.000025 = 15,600 زائر لكل نسخة. المعادلة القياسية الكاملة لمقارنة نسبتين تعطي رقمًا أعلى قليلًا (قرابة 16,800).
| النسبة الحالية | أصغر أثر يستحق (نسبي) | زوار لكل نسخة (تقريبًا) |
|---|---|---|
| 2.5% | +10% (إلى 2.75%) | 64,000 |
| 2.5% | +20% (إلى 3.0%) | 16,800 |
| 2.5% | +30% (إلى 3.25%) | 7,800 |
| 2.5% | +50% (إلى 3.75%) | 3,000 |
| 60% | +10% (إلى 66%) | 1,000 |
الأرقام محسوبة بالمعادلة القياسية لمقارنة نسبتين بالافتراضات السابقة. استخدمها لتعرف المقاس، لا كرقم دقيق. ثم: المدة = إجمالي العينة ÷ الزوار اليوميين، مقربة لأسابيع كاملة. GrowthBook يوصي بأسبوع إلى أسبوعين على الأقل لالتقاط اختلاف أيام الأسبوع.
إن احتاجت التجربة أكثر من 4 أسابيع: اختبر تغييرًا أكبر يستحق أثرًا أكبر، أو اختبر مقياسًا بنسبة أعلى (مثل تأكيد الطلبات بدل الشراء)، أو أجّل التجربة. مقارنة «قبل وبعد» بلا تقسيم عشوائي ممكنة، لكنها دليل أضعف: الموسم وتغيير الإعلانات يختلطان بأثر التغيير، فراقب المقاييس الحامية واعتبر النتيجة إشارة لا حكمًا.
قبل الإطلاق، اكتب ماذا ستفعل في كل حالة:
لماذا لا تنظر وتوقف مبكرًا؟ حسابات الدلالة الكلاسيكية تفترض أن حجم العينة حُدد مسبقًا. في أحد أمثلة إيفان ميلر، إيقاف الاختبار عند أول نتيجة «ذات دلالة» رفع احتمال الفوز الكاذب إلى 26.1% بدل 5%. التمديد لأن النتيجة «قريبة» يكسر الافتراض نفسه. إن كنت تحتاج أن تنظر أثناء الاختبار، استخدم أداة تدعم الاختبار المتتابع (Sequential testing)، وهي طريقة إحصائية مصممة للنظر المتكرر دون رفع نسبة الأخطاء.
عند موعد القراءة، اكتب ثلاثة أرقام: الفرق في المقياس الأساسي، ومدى الثقة (Confidence interval) حوله، وحالة المقاييس الحامية. ثم نفّذ القاعدة المكتوبة كما هي.
النتيجة غير الحاسمة ليست «فشلًا» ولا «الفكرة لا تعمل». معناها: لم نرَ أثرًا بالحجم الذي صممنا التجربة لرؤيته. اكتبها هكذا في السجل. توثيق GrowthBook يقترح سياسة مكتوبة لهذه الحالة: العودة للنسخة الأصلية، إلا إذا كانت النسخة الجديدة تفتح شيئًا آخر تحتاجه.
كل تجربة، فائزة أو خاسرة أو غير حاسمة، تأخذ سطرًا في السجل بالصيغة نفسها المستخدمة في مراجعة الحملات. هذا السجل هو ما تعطيه لجلسة الترتيب القادمة تحت بند «ما جُرّب سابقًا».
مثال افتراضي للتعليم — ليس عميلًا حقيقيًا، والأرقام مفترضة لشرح الطريقة
متجر افتراضي يبيع بالدفع عند الاستلام. صفحات المنتجات تستقبل 1,600 زائر يوميًا، ونسبة الطلب (الطلبات ÷ زوار صفحة المنتج) 2.5%. هذا عنق الزجاجة: الإعلانات تجلب زوارًا بتكلفة مقبولة، لكنهم لا يطلبون.
| الفكرة | الأثر | الثقة | السهولة | المتوسط | السبب |
|---|---|---|---|---|---|
| سطر «افتح الشحنة واتأكد منها قبل ما تدفع» تحت زر الطلب | 7 | 6 | 9 | 7.3 | 40 من 120 سؤالًا على واتساب الشهر الماضي كانت عن المعاينة |
| شحن مجاني فوق 600 جنيه | 5 | 4 | 6 | 5.0 | يمس متوسط الطلب أكثر من نسبة الطلب |
| إعلانات تيك توك | 3 | 3 | 4 | 3.3 | يجلب زوارًا، والمشكلة ليست في عددهم |
| برنامج إحالة | 2 | 2 | 3 | 2.3 | خارج عنق الزجاجة الآن: قائمة انتظار |
| النسخة | الزوار | الطلبات | نسبة الطلب | المسلّم | نسبة التسليم |
|---|---|---|---|---|---|
| الأصلية | 16,800 | 420 | 2.50% | 315 | 75.0% |
| مع السطر | 16,800 | 470 | 2.80% | 348 | 74.0% |
الفرق +12% نسبيًا، لكن مدى الثقة 95% حوله يمتد تقريبًا من −2% إلى +26%. يشمل الصفر، فالنتيجة غير حاسمة. نسبة التسليم انخفضت نقطة واحدة، داخل الحد.
الفريق أراد التمديد أسبوعًا «لأنها قريبة». القاعدة المكتوبة منعت ذلك. النسخة الأصلية عادت، وكُتب في السجل: «لم نرَ أثرًا بحجم 20%. الأثر الحقيقي قد يكون صفرًا أو قرابة 25%». التجربة التالية تختبر الفكرة نفسها بتغيير أقوى: فيديو قصير يشرح المعاينة بجانب السعر، بفرضية وعينة جديدتين.
املأ الأقواس والصق قائمة أفكارك كما هي، ثم استخدمه في ChatGPT أو Claude أو Gemini. الأمر يمنع النموذج من اختراع أرقام أو أدلة، ويطلب منه أن يعلن ما ينقصه.
أنت قائد تجارب نمو. حوّل قائمة أفكاري إلى قائمة تجارب مرتبة. الفكرة التي لا يمكن أن تنتهي بقرار ليست تجربة. قواعد العمل: - لا تخترع أرقامًا أو أدلة. إن نقصتك بيانات (حجم الزيارات، النسبة الحالية، الدليل)، اذكرها واطلبها قبل الترتيب. - افصل بين الدليل الموجود فعلًا (من بياناتي أو عملائي) والافتراض أو الرأي. - حسابات حجم العينة تقريبية؛ اذكر افتراضاتها. السياق: - المنتج ونموذج النمو في فقرة: [ ] - عنق الزجاجة الآن (جذب / تفعيل / احتفاظ / إيراد) والدليل: [ ] - المقياس الذي يعبّر عنه بالبسط والمقام، وقيمته الحالية: [ ] - الزيارات أو المستخدمون شهريًا على الخطوة التي سنختبرها: [ ] - القدرة على التقسيم العشوائي (أداة A/B أو لا): [ ] - الموارد (من ينفذ، الميزانية): [ ] - تجارب سابقة ونتائجها: [ألصق أسطر السجل، أو «لا يوجد سجل»] قائمة الأفكار: [ألصقها بأي شكل] لكل فكرة: 1. الفرضية: «نعتقد أن [تغيير محدد] سيرفع [المقياس] من [الحالي] إلى [المتوقع] على الأقل، لأن [دليل]». إن لم يوجد «لأن» صادق، ضعها في قائمة «تحتاج بحثًا أولًا» ولا ترتبها. 2. أصغر اختبار يعطي جوابًا: أصغر نسخة وأرخصها (زر وهمي لقياس الاهتمام، تنفيذ يدوي لعدد قليل من العملاء، تقسيم بالمدن، إطلاق على جزء من الزوار). صغّر النطاق، لا الدقة. 3. المقياس الأساسي الواحد، والمقاييس الحامية مع حد كل منها. 4. العينة والمدة: بافتراض دلالة 5% وقوة 80%، هل تصل إلى نتيجة مقروءة خلال 4 أسابيع بحجم زياراتي؟ إن لا: اقترح تغييرًا أكبر، أو مقياسًا بنسبة أعلى، أو أجّلها. 5. قاعدة القرار مكتوبة الآن: متى نعتمد، ومتى نوقف، وماذا نفعل لو كانت غير حاسمة، وموعد القراءة. 6. درجات ICE (الأثر على عنق الزجاجة وحده، الثقة حسب قوة الدليل: بيانات العملاء أقوى من تجربة منافس، وهذه أقوى من رأي، السهولة) مع سبب مكتوب لكل درجة. ثم أخرج: - جدول التجارب مرتبًا، وأول 3 تجارب مقترحة لهذه الدورة. - التعارضات: أي تجارب تمس الصفحة نفسها أو المقياس نفسه ولا يصح تشغيلها معًا. - التجربة الغائبة: أعلى تجربة أثرًا على عنق الزجاجة ليست في قائمتي، ولماذا قد أكون أتجنبها. - قائمة البيانات الناقصة التي ستجعل الترتيب أدق.
املأها قبل الإطلاق، واحفظها مع تاريخ اليوم. لا تغيّر قاعدة القرار بعد أن تبدأ التجربة.
اسم التجربة: [ ] المسؤول: [ ] تاريخ الإطلاق: [ ] تاريخ القراءة: [ ] عنق الزجاجة والدليل: [ ] الفرضية: نعتقد أن [تغيير محدد] سيرفع [المقياس] من [الحالي] إلى [المتوقع] على الأقل، لأن [دليل]. المقياس الأساسي (البسط ÷ المقام): [ ] القيمة الحالية: [ ] أصغر أثر يستحق: [نسبي ومطلق] المقاييس الحامية وحد كل منها: - [المقياس]: لا ينخفض أكثر من [ ] - [المقياس]: لا ينخفض أكثر من [ ] المقاييس الثانوية (للتعلم فقط): [ ] التصميم: - النسخ: الأصلية مقابل [ ] - وحدة التقسيم (زائر، مستخدم، مدينة): [ ] - نسبة التقسيم: [50/50] - حجم العينة لكل نسخة: [ ] (دلالة 5%، قوة 80%) - المدة: [ ] أسابيع كاملة - تجارب أخرى تعمل على الصفحة نفسها أو المقياس نفسه: [لا يوجد / اذكرها] قاعدة القرار (تُكتب قبل الإطلاق ولا تُعدّل): - فوز: [ ] ← [ ] - خسارة أو تجاوز حد حامٍ: [ ] ← [ ] - غير حاسمة: [ ] ← [ ] النتيجة (تُملأ يوم القراءة فقط): الفرق: [ ] مدى الثقة: [ ] المقاييس الحامية: [ ] القرار المنفذ: [ ]
سطر لكل تجربة في ملف واحد. الصيغة نفسها في قالب مراجعة الحملة، فيجمع السجل التجارب والحملات معًا.
التاريخ | الاسم | الفرضية | التصميم | النتيجة | القرار | القاعدة ونطاقها 2026-09-20 | سطر المعاينة قبل الدفع | السطر يرفع نسبة الطلب من 2.5% إلى 3.0%+ لأن ثلث أسئلة واتساب عن المعاينة | A/B على صفحات المنتج، 16,800 زائر لكل نسخة، 21 يومًا، حامٍ: نسبة التسليم -3 نقاط | 2.50% مقابل 2.80%، مدى الثقة من -2% إلى +26% نسبيًا، التسليم -1 نقطة: غير حاسمة | عودة للأصل، وإعادة الاختبار بفيديو يشرح المعاينة | لا قاعدة
برنامج التجارب ينجح عندما تتحسن قراراتك، لا عندما يكثر عدد الاختبارات. راقب كل شهر:
أعد جلسة الترتيب شهريًا. عنق الزجاجة يتحرك، والقائمة القديمة تفقد صلاحيتها.
لاحظت خطأ أو رقمًا تغيّر؟ أرسل لنا التصحيح.