جودة الملاءمة

يصف مدى ملاءمة النموذج الإحصائي مدى توافقه مع مجموعة من المشاهدات. وتلخص مقاييس جودة المطابقة عادةً التباين بين القيم المرصودة والقيم المتوقعة في ظل النموذج قيد الدراسة. ويمكن استخدام هذه المقاييس في اختبار الفرضيات الإحصائية ، على سبيل المثال لاختبار اعتدالية البواقي ، أو لاختبار ما إذا كانت عينتان مسحوبتان من توزيعات متطابقة (انظر اختبار كولموغوروف-سميرنوف )، أو ما إذا كانت ترددات النتائج تتبع توزيعًا محددًا (انظر اختبار مربع كاي لبيرسون ). وفي تحليل التباين ، قد يكون أحد مكونات التباين هو مجموع مربعات عدم المطابقة .

ملاءمة التوزيعات

عند تقييم ما إذا كان توزيع معين مناسبًا لمجموعة بيانات، يمكن استخدام الاختبارات التالية ومقاييس المطابقة الأساسية الخاصة بها:

تحليل الانحدار

في تحليل الانحدار ، وتحديداً التحقق من صحة الانحدار ، تتعلق المواضيع التالية بجودة المطابقة:

البيانات الفئوية

فيما يلي أمثلة تظهر في سياق البيانات الفئوية .

اختبار مربع كاي لبيرسون

يستخدم اختبار مربع كاي لبيرسون مقياسًا لجودة المطابقة وهو مجموع الفروق بين ترددات النتائج الملاحظة والمتوقعة (أي عدد الملاحظات)، حيث يتم تربيع كل منها وقسمتها على القيمة المتوقعة:

χ2=أنا=1ن(ياأنا-هـأنا)هـأنا2{\displaystyle \chi ^{2}=\sum _{i=1}^{n}{{\frac {(O_{i}-E_{i})}{E_{i}}}^{2}}} أين:

يتم حساب التردد المتوقع من خلال: هـأنا=(F(Yu)-F(Yل))شمال{\displaystyle E_{i}\,=\,{\bigg (}F(Y_{u})\,-\,F(Y_{l}){\bigg )}\,N} أين:

يمكن مقارنة القيمة الناتجة بتوزيع كاي تربيع لتحديد مدى جودة المطابقة. يمتلك توزيع كاي تربيع ( k - c ) درجة حرية ، حيث k هو عدد الفئات غير الفارغة، و c هو عدد المعلمات المقدرة (بما في ذلك معلمات الموقع والمقياس والشكل) للتوزيع زائد واحد. على سبيل المثال، بالنسبة لتوزيع ويبول ذي 3 معلمات ، فإن c = 4.

الحالة ذات الحدين

التجربة ذات الحدين هي سلسلة من المحاولات المستقلة التي يمكن أن تؤدي إلى إحدى نتيجتين: النجاح أو الفشل. يوجد n محاولة ، لكل منها احتمال نجاح يُرمز له بـ p . بشرط أن يكون npᵢ 1 لكل i (حيث i = 1، 2، ...، k )، فإن       

χ2=أنا=1ك(شمالأنا-نصأنا)2نصأنا=ألل بأنانs(يا-هـ)2هـ.$

يتبع هذا التوزيع تقريبًا توزيع كاي تربيع بدرجات حرية k 1. إن وجود k 1 درجة حرية هو نتيجة للقيد.    شمالأنا=ن{\textstyle \sum N_{i}=n}نعلم أن هناك k من قيم عدد الخانات المرصودة، ولكن بمجرد معرفة أي k 1 منها، تُحدد القيمة المتبقية بشكل فريد. بمعنى آخر، يمكن القول إن هناك k 1 قيمة عدد خانات محددة بحرية فقط، وبالتالي k 1 درجة من درجات الحرية.      

اختبار G

اختبارات G هياختبارات نسبة الاحتمال للدلالة الإحصائية ، ويتم استخدامها بشكل متزايد في الحالات التي كانت يوصى فيها سابقًا باختبارات مربع كاي لبيرسون. [ 7 ]

الصيغة العامة لـ G هي

جي=2أناياأناln(ياأناهـأنا)،{\displaystyle G=2\sum _{i}{O_{i}\cdot \ln \left({\frac {O_{i}}{E_{i}}}\right)},}

أينياأنا{\textstyle O_{i}}وهـأنا{\textstyle E_{i}}وهي نفسها المستخدمة في اختبار مربع كاي،ln{\textstyle \ln }يرمز إلى اللوغاريتم الطبيعي ، ويُحسب المجموع على جميع الخانات غير الفارغة. علاوة على ذلك، يجب أن يكون إجمالي العدد المُلاحظ مساويًا لإجمالي العدد المتوقع.أناياأنا=أناهـأنا=شمال{\displaystyle \sum _{i}O_{i}=\sum _{i}E_{i}=N}أينشمال{\textstyle N}يمثل العدد الإجمالي للملاحظات.

وقد تم التوصية باختبارات G على الأقل منذ طبعة عام 1981 من كتاب الإحصاء الشهير الذي ألفه روبرت ر. سوكال وإف . جيمس رولف . [ 8 ]

انظر أيضاً

مراجع

  1. ^ بيرك، روبرت هـ. جونز، دوغلاس هـ. (1979). “إحصائيات اختبار جودة الملاءمة التي تهيمن على إحصائيات كولموجوروف”. Zeitschrift für Wahrscheinlichkeitstheorie und Verwandte Gebiete . 47 (1): 47-59 . دوى : 10.1007 / BF00533250 .
  2. موسكوفيتش، أميت؛ نادلر، بواز؛ سبيجلمان، كليفورد (2016). "حول إحصائيات بيرك-جونز الدقيقة وحساب قيمة الاحتمال الخاصة بها". المجلة الإلكترونية للإحصاء . 10 (2). arXiv : 1311.3190 . doi : 10.1214/16-EJS1172 .
  3. ليو، تشيانغ؛ لي، جيسون؛ جوردان، مايكل (20 يونيو 2016). "تباين شتاين المُحسَّن لاختبارات جودة المطابقة" . وقائع المؤتمر الدولي الثالث والثلاثين للتعلم الآلي . المؤتمر الدولي الثالث والثلاثون للتعلم الآلي. نيويورك، نيويورك، الولايات المتحدة الأمريكية: وقائع بحوث التعلم الآلي. الصفحات 276-284 . 
  4. تشويالكوفسكي، كاسبر؛ ستراثمان، هايكو؛ جريتون، آرثر (20 يونيو 2016). "اختبار النواة لمدى جودة المطابقة" . وقائع المؤتمر الدولي الثالث والثلاثين للتعلم الآلي . المؤتمر الدولي الثالث والثلاثون للتعلم الآلي. نيويورك، نيويورك، الولايات المتحدة الأمريكية: وقائع بحوث التعلم الآلي. الصفحات 2606-2615 . 
  5. تشانغ، جين (2002). "اختبارات جودة المطابقة القوية القائمة على نسبة الاحتمال" (ملف PDF) . مجلة الجمعية الملكية للإحصاء، السلسلة ب ، 64 (2): 281-294 . doi : 10.1111/1467-9868.00337 . تاريخ الاسترجاع: 5 نوفمبر 2018 .
  6. فيكسلر، ألبرت؛ غوريفيتش، غريغوري (2010). "نسب الاحتمال التجريبية المطبقة على اختبارات جودة المطابقة بناءً على إنتروبيا العينة". الإحصاءات الحاسوبية وتحليل البيانات . 54 (2): 531-545 . doi : 10.1016/j.csda.2009.09.025 .
  7. ماكدونالد، جيه إتش (2014). "اختبار جي لجودة المطابقة". دليل الإحصاء البيولوجي ( الطبعة الثالثة). بالتيمور، ماريلاند: دار سباركي هاوس للنشر. الصفحات 53-58 .  
  8. سوكال، ر. ر.؛ رولف، ف. ج. (1981). القياسات الحيوية: مبادئ وممارسة الإحصاء في البحوث البيولوجية ( الطبعة الثانية). دبليو إتش فريمان . رقم ISBN  0-7167-2411-1.

للمزيد من القراءة

  • هوبر-كارول، سي.؛ بالاكريشنان، ن.؛ نيكولين، إم إس؛ مصباح، م.، محررون (2002)، اختبارات جودة المطابقة وصحة النموذج ، سبرينغر
  • إنجستر، يو. آي.؛ سوسلينا، آي. إيه. (2003)، اختبار جودة المطابقة غير البارامتري في ظل النماذج الغاوسية ، سبرينغر
  • راينر، جيه سي دبليو؛ ثاس، أو؛ بيست، دي جيه (2009)، اختبارات سلسة لجودة المطابقة (الطبعة الثانية  وايلي
  • فيكسلر، ألبرت؛ غوريفيتش، غريغوري (2010)، "نسب الاحتمال التجريبية المطبقة على اختبارات جودة المطابقة بناءً على إنتروبيا العينة"، الإحصاءات الحاسوبية وتحليل البيانات ، 54 (2): 531-545 ، doi : 10.1016/j.csda.2009.09.025