تقدير الاحتمال الأقصى
في الإحصاء ، يُعد تقدير الاحتمال الأقصى ( MLE ) طريقةً لتقدير معلمات توزيع احتمالي مفترض ، بالنظر إلى بيانات مُرصَدة. ويتحقق ذلك من خلال تعظيم دالة الاحتمال بحيث تكون البيانات المُرصَدة، في ظل النموذج الإحصائي المفترض ، هي الأكثر احتمالاً . تُسمى النقطة في فضاء المعلمات التي تُعظّم دالة الاحتمال بتقدير الاحتمال الأقصى. [ 1 ] يتميز منطق الاحتمال الأقصى بالبديهية والمرونة، ولذلك أصبحت هذه الطريقة وسيلةً سائدةً للاستدلال الإحصائي . [ 2 ] [ 3 ] [ 4 ]
إذا كانت دالة الاحتمال قابلة للتفاضل ، فيمكن تطبيق اختبار المشتقة لإيجاد القيم العظمى. في بعض الحالات، يمكن حل شروط الرتبة الأولى لدالة الاحتمال تحليليًا؛ على سبيل المثال، يُعظّم مُقدِّر المربعات الصغرى العادية لنموذج الانحدار الخطي الاحتمال عندما يُفترض أن الأخطاء العشوائية لها توزيعات طبيعية بنفس التباين. [ 5 ]
من منظور الاستدلال البايزي ، يُعادل تقدير الاحتمال الأقصى (MLE) عمومًا تقدير الاحتمال اللاحق الأقصى (MAP) مع توزيع احتمالي مسبق منتظم في المنطقة محل الاهتمام. أما في الاستدلال التكراري ، فيُعدّ تقدير الاحتمال الأقصى حالة خاصة من تقدير القيم القصوى ، حيث تكون دالة الهدف هي دالة الاحتمال.
مبادئ
نُنمذج مجموعة من المشاهدات كعينة عشوائية من توزيع احتمالي مشترك غير معروف ، يُعبَّر عنه بدلالة مجموعة من المعاملات . يهدف تقدير الاحتمال الأقصى إلى تحديد المعاملات التي تُعطي البيانات المرصودة أعلى احتمال مشترك. نكتب المعاملات التي تحكم التوزيع المشترك كمتجه.بحيث يندرج هذا التوزيع ضمن عائلة بارامتريةأينيُطلق عليه اسم فضاء المعلمات ، وهو مجموعة فرعية محدودة الأبعاد من الفضاء الإقليدي . يتم تقييم الكثافة المشتركة عند عينة البيانات المرصودة.تعطي دالة ذات قيم حقيقية، ;\mathbf {y} )=f_{n}(\mathbf {y} ;\theta )\;,} والتي تسمى دالة الاحتمالية . للمتغيراتالعشوائية المستقلة ;\theta )} سيكون ناتج دوال الكثافة أحادية المتغير : ;\theta )=\prod _{k=1}^{n}\,f_{k}^{\mathsf {univar}}(y_{k};\theta )~.}
الهدف من تقدير الاحتمال الأقصى هو إيجاد قيم معلمات النموذج التي تزيد من دالة الاحتمال على فضاء المعلمات، [ 6 ] أي:
وبشكل بديهي، يختار هذا قيم المعلمات التي تجعل البيانات المرصودة أكثر احتمالاً. القيمة المحددةالذي يزيد من دالة الاحتماليةيُطلق عليه تقدير الاحتمال الأقصى. علاوة على ذلك، إذا كانت الدالةإذا كانت الدالة قابلة للقياس وفقًا لهذا التعريف ، فإنها تُسمى مُقدِّر الاحتمال الأقصى . وهي عادةً دالة مُعرَّفة على فضاء العينة ، أي تأخذ عينة مُعطاة كمتغير لها. ومن الشروط الكافية، ولكن ليس الضرورية، لوجودها أن تكون دالة الاحتمال متصلة على فضاء المعلمات.أي أنها مضغوطة . [ 7 ] بالنسبة لـقد تزداد دالة الاحتمالية دون أن تصل أبدًا إلى قيمة عظمى.
من الناحية العملية، غالباً ما يكون من الملائم العمل مع اللوغاريتم الطبيعي لدالة الاحتمالية، والذي يسمى لوغاريتم الاحتمالية : بما أن اللوغاريتم دالة رتيبة ، فإن القيمة القصوى لـيحدث ذلك عند نفس قيمةوكذلك الحد الأقصى لـ[ 8 ] إذاقابلة للتفاضل فيالشروط اللازمة لحدوث قيمة عظمى (أو صغرى) هي تُعرف هذه المعادلات بمعادلات الاحتمالية. بالنسبة لبعض النماذج، يمكن حل هذه المعادلات بشكل صريح لـلكن بشكل عام، لا يوجد حل مغلق معروف أو متاح لمسألة التعظيم، ولا يمكن إيجاد تقدير الاحتمال الأقصى إلا من خلال التحسين العددي . مشكلة أخرى هي أنه في العينات المحدودة، قد توجد جذور متعددة لمعادلات الاحتمال. [ 9 ] هل الجذر المحدديعتمد كون معادلات الاحتمالية تمثل قيمة عظمى (محلية) على ما إذا كانت مصفوفة المشتقات الجزئية والمتقاطعة من الرتبة الثانية، والتي تُسمى مصفوفة هيسيان،
سالبة شبه محددة عندوهذا يدل على التقعر الموضعي . ومن الملائم أن معظم التوزيعات الاحتمالية الشائعة - وخاصة عائلة التوزيعات الأسية - تكون مقعرة لوغاريتميًا . [ 10 ] [ 11 ]
مساحة المعلمات المقيدة
على الرغم من أن نطاق دالة الاحتمال - فضاء المعلمات - هو عمومًا مجموعة فرعية محدودة الأبعاد من الفضاء الإقليدي ، إلا أنه قد يلزم أحيانًا دمج قيود إضافية في عملية التقدير. ويمكن التعبير عن فضاء المعلمات على النحو التالي: :\theta \in \mathbb {R} ^{k},\;h(\theta )=0\right\}~,}
أينهي دالة ذات قيم متجهةداخلتقدير المعلمة الحقيقيةينتمي إلىثم، من الناحية العملية، يعني ذلك إيجاد القيمة القصوى لدالة الاحتمال مع مراعاة القيد.
من الناحية النظرية، فإن النهج الأكثر طبيعية لحل مشكلة التحسين المقيد هذه هو طريقة الاستبدال، أي "ملء" القيودإلى مجموعةبطريقة تجعلهي دالة أحادية منإلى نفسها، وإعادة تحديد معلمات دالة الاحتمال عن طريق ضبط[ 12 ] نظرًا لتكافؤ التباين لمُقدِّر الاحتمال الأقصى، فإن خصائص هذا المُقدِّر تنطبق أيضًا على التقديرات المُقيَّدة. [ 13 ] على سبيل المثال، فيالتوزيع الطبيعي متعدد المتغيرات،تكون مصفوفة التباينالمشتركيجب أن تكون موجبة تمامًا ؛ ويمكن فرض هذا القيد عن طريق الاستبدالأينهي مصفوفة مثلثية علوية حقيقية وهو منقوله . [ 14 ]
عمليًا، تُفرض القيود عادةً باستخدام طريقة لاغرانج، والتي تؤدي، في ضوء القيود المحددة أعلاه، إلى معادلات الاحتمالية المقيدة.و
أينهو متجه عمودي من مُضاعِفات لاغرانج وهي مصفوفة جاكوبيان للمشتقات الجزئية من الرتبة k × r . [ 12 ] وبطبيعة الحال، إذا لم تكن القيود ملزمة عند القيمة القصوى، فإن معاملات لاغرانج يجب أن تكون صفرًا. [ 15 ] وهذا بدوره يسمح بإجراء اختبار إحصائي لـ "صحة" القيد، يُعرف باسم اختبار معامل لاغرانج .
تقدير الاحتمال الأقصى غير البارامتري
يمكن إجراء تقدير الاحتمال الأقصى غير البارامتري باستخدام الاحتمال التجريبي .
طريقة الدعم
طريقة الدعم هي تقنية تُستخدم لاستخلاص استنتاجات من مجموعات البيانات. ووفقًا لـ AWF Edwards [ 16 ] ، تهدف طريقة الدعم إلى استخلاص استنتاجات حول المعلمات المجهولة من خلال الدعم النسبي، أو دالة الاحتمال اللوغاريتمي ، المُستنتجة من مجموعة بيانات لقيمة معينة للمعلمة. ويمكن استخدام هذه التقنية سواءً توفرت معلومات مسبقة أم لا. تُعد طريقة الاحتمال الأقصى جزءًا من طريقة الدعم، ولكن تجدر الإشارة إلى أن طريقة الدعم تُوفر أيضًا مناطق ثقة مُحددة بناءً على دعمها.
ملكيات
مقدِّر الاحتمال الأقصى هو مقدِّر للقيم القصوى يتم الحصول عليه عن طريق تعظيم دالة الهدف كدالة لـ θإذا كانت البيانات مستقلة وموزعة توزيعًا متطابقًا ، فسنحصل على وهذا هو النظير النموذجي للوغاريتم الاحتمالية المتوقعة، حيث يتم أخذ هذا التوقع بالنسبة للكثافة الحقيقية.
لا تتمتع مُقدِّرات الاحتمال الأقصى بخصائص مثلى للعينات المحدودة، بمعنى أنه (عند تقييمها على عينات محدودة) قد يكون للمُقدِّرات الأخرى تركيز أكبر حول القيمة الحقيقية للمعلمة. [ 17 ] ومع ذلك، مثل طرق التقدير الأخرى، يمتلك تقدير الاحتمال الأقصى عددًا من الخصائص الحدية الجذابة : فمع ازدياد حجم العينة إلى ما لا نهاية، تتمتع متواليات مُقدِّرات الاحتمال الأقصى بالخصائص التالية:
- الاتساق : يتقارب تسلسل تقديرات الاحتمال الأقصى في الاحتمالية إلى القيمة التي يتم تقديرها.
- التباين المتساوي : إذاهو مُقدِّر الاحتمال الأقصى لـوإذاهو تحويل تقابلي لـثم يكون مقدر الاحتمال الأقصى لـيكونيمكن تعميم خاصية التباين المتساوي على التحويلات غير التقابلية، على الرغم من أنها تنطبق في تلك الحالة على الحد الأقصى لدالة الاحتمال المستحثة والتي ليست الاحتمال الحقيقي بشكل عام.
- الكفاءة ، أي أنها تحقق الحد الأدنى لكريمر-راو عندما يؤول حجم العينة إلى اللانهاية. هذا يعني أنه لا يوجد مقدر متسق له متوسط خطأ تربيعي تقاربي أقل من تقدير الاحتمال الأقصى (أو أي مقدر آخر يحقق هذا الحد)، مما يعني أيضاً أن تقدير الاحتمال الأقصى يتمتع بالتقارب الطبيعي .
- كفاءة من الدرجة الثانية بعد تصحيح الانحياز.
تناسق
في ظل الشروط الموضحة أدناه، يكون مُقدِّر الاحتمال الأقصى متسقًا . ويعني الاتساق أنه إذا تم توليد البيانات بواسطةوإذا كان لدينا عدد كبير بما فيه الكفاية من المشاهدات n ، فمن الممكن إيجاد قيمة θ₀ بدقة اختيارية. رياضياً، هذا يعني أنه عندما يؤول n إلى اللانهاية، فإن المُقدِّريتقارب احتمالياً مع قيمته الحقيقية:
في ظل شروط أقوى قليلاً، يتقارب المقدر بشكل شبه مؤكد (أو بقوة ):
في التطبيقات العملية، لا يتم توليد البيانات بواسطة. بدلاً من،هو نموذج، غالبًا ما يكون بصورة مثالية، للعملية الناتجة عن البيانات. ومن المقولات الشائعة في الإحصاء أن جميع النماذج خاطئة . لذا، لا يتحقق الاتساق الحقيقي في التطبيقات العملية. ومع ذلك، يُعتبر الاتساق في كثير من الأحيان خاصية مرغوبة في المُقدِّر.
لضمان الاتساق، تكفي الشروط التالية. [ 18 ]
- تحديد النموذج: بمعنى آخر، تتوافق قيم المعلمات المختلفة θ مع توزيعات مختلفة داخل النموذج. إذا لم يتحقق هذا الشرط، فستكون هناك قيمة θ₁ بحيث تُولّد θ₀ و θ₁ توزيعًا متطابقًا للبيانات المرصودة. عندئذٍ ، لن نتمكن من التمييز بين هاتين المعلمتين حتى مع كمية لا نهائية من البيانات، إذ ستكونان متكافئتين رصديًا. يُعد شرط التحديد ضروريًا للغاية لكي يكون مُقدِّر الاحتمال الأقصى متسقًا . عندما يتحقق هذا الشرط، يكون لدالة الاحتمال الحدي ℓ ( θ |·) قيمة عظمى عالمية فريدة عند θ₀ .
- التراص: فضاء المعلمات Θ للنموذج متراص .

يُثبت شرط التحديد أن دالة الاحتمال اللوغاريتمي لها قيمة عظمى عالمية فريدة. ويعني التراص أن دالة الاحتمال لا يمكن أن تقترب من القيمة العظمى بشكل عشوائي عند أي نقطة أخرى (كما هو موضح على سبيل المثال في الصورة على اليمين).
يُعدّ التراص شرطًا كافيًا فقط، وليس شرطًا ضروريًا. ويمكن استبدال التراص بشروط أخرى، مثل:
- الاستمرارية: الدالة ln f ( x | θ ) مستمرة في θ لجميع قيم x تقريبًا : يمكن استبدال الاستمرارية هنا بشرط أضعف قليلاً وهو شبه الاستمرارية العليا .
- الهيمنة: يوجد D ( x ) قابل للتكامل بالنسبة للتوزيع f ( x | θ0 ) بحيث بحسب قانون الأعداد الكبيرة المنتظم ، فإن شرط الهيمنة بالإضافة إلى الاستمرارية يثبتان التقارب المنتظم في احتمالية اللوغاريتم الاحتمالي:
يمكن استخدام شرط الهيمنة في حالة المشاهدات المستقلة والمتطابقة التوزيع . أما في حالة المشاهدات غير المستقلة والمتطابقة التوزيع، فيمكن التحقق من التقارب المنتظم في الاحتمال من خلال إثبات أن المتتاليةهي متصلة بشكل متساوٍ عشوائياً .
إذا أراد المرء أن يثبت أن مقدر الاحتمال الأقصىإذا تقاربت إلى θ 0 بشكل شبه مؤكد ، فيجب فرض شرط أقوى للتقارب المنتظم بشكل شبه مؤكد:
بالإضافة إلى ذلك، إذا تم إنشاء البيانات بواسطة (كما هو مفترض أعلاه)ثم، في ظل شروط معينة، يمكن أيضًا إثبات أن مقدر الاحتمال الأقصى يتقارب في التوزيع إلى التوزيع الطبيعي. على وجه التحديد، [ 19 ] حيث I هي مصفوفة معلومات فيشر .
الثبات الوظيفي
يختار مُقدِّر الاحتمال الأقصى قيمة المعلمة التي تُعطي البيانات المرصودة أكبر احتمال ممكن (أو كثافة احتمالية، في الحالة المستمرة). إذا كانت المعلمة تتكون من عدد من المكونات، فإننا نُعرِّف مُقدِّرات الاحتمال الأقصى المنفصلة لكل منها، باعتبارها المكون المُناظر من مُقدِّر الاحتمال الأقصى للمعلمة الكاملة. وبناءً على ذلك، إذاهو الحد الأدنى لتقدير الاحتمالية لـوإذاأي تحول منثم تقدير الاحتمال الأقصى لـهو بحكم التعريف [ 20 ]
إنه يزيد من احتمالية الملف الشخصي :
α = g(θ) L(θ).
كما أن تقدير الاحتمال الأقصى (MLE) متغيرٌ بالنسبة لبعض تحويلات البيانات. إذاأينإذا كانت العلاقة أحادية ولا تعتمد على المعاملات المراد تقديرها، فإن دوال الكثافة تحقق
وبالتالي دوال الاحتمال لـولا يختلف إلا بعامل لا يعتمد على معلمات النموذج.
على سبيل المثال، تكون معلمات تقدير الاحتمال الأقصى للتوزيع اللوغاريتمي الطبيعي هي نفسها معلمات التوزيع الطبيعي المُطابق للوغاريتم البيانات. في الواقع، في حالة التوزيع اللوغاريتمي الطبيعي إذا، ثميتبع توزيعًا لوغاريتميًا طبيعيًا . كثافة Y تتبع معالوضع الطبيعي القياسي،ل.
كفاءة
كما هو مفترض أعلاه، إذا تم إنشاء البيانات بواسطةثم، في ظل شروط معينة، يمكن أيضًا إثبات أن مُقدِّر الاحتمال الأقصى يتقارب في التوزيع إلى التوزيع الطبيعي. وهو متسق من الدرجة √n وفعال تقاربياً، مما يعني أنه يصل إلى حد كرامر-راو . تحديدًا، [ 19 ]
أينمصفوفة معلومات فيشر :
وعلى وجه الخصوص ، هذا يعني أن انحياز مقدر الاحتمال الأقصى يساوي صفرًا حتى الرتبة 1 / √ n .
كفاءة من الدرجة الثانية بعد تصحيح الانحياز
مع ذلك، عند النظر في الحدود ذات الرتبة الأعلى في توسيع توزيع هذا المُقدِّر، يتضح أن θ mle له انحياز من الرتبة 1 / n . هذا الانحياز يساوي (مكونًا مكونًا) [ 21 ].
أين(مع الأرقام المرتفعة) تشير إلى المكون ( j,k ) من مصفوفة معلومات فيشر العكسية، و
باستخدام هذه الصيغ، من الممكن تقدير الانحياز من الدرجة الثانية لمقدر الاحتمال الأقصى، وتصحيح هذا الانحياز عن طريق طرحه: هذا المقدر غير متحيز حتى الحدود من الرتبة 1 / n ، ويسمى مقدر الاحتمال الأقصى المصحح للتحيز .
يُعدّ هذا المُقدِّر المُصحَّح للتحيز فعالاً من الدرجة الثانية (على الأقل ضمن عائلة الدوال الأسية المنحنية)، ما يعني أنه يتميز بأقل متوسط مربع خطأ بين جميع المُقدِّرات المُصحَّحة للتحيز من الدرجة الثانية، حتى حدود الرتبة 1 / n² . ويمكن مواصلة هذه العملية، أي اشتقاق حد تصحيح التحيز من الدرجة الثالثة، وهكذا. مع ذلك، فإن مُقدِّر الاحتمال الأقصى ليس فعالاً من الدرجة الثالثة. [ 22 ]
العلاقة بالاستدلال البايزي
يتطابق مُقدِّر الاحتمال الأقصى مع مُقدِّر بايزي الأكثر احتمالاً عند وجود توزيع احتمالي منتظم مسبق على المعلمات . في الواقع، فإن تقدير الاحتمال اللاحق الأقصى هو المعلمة θ التي تُعظِّم احتمال θ بالنظر إلى البيانات، وفقًا لنظرية بايز.
أينيمثل التوزيع المسبق للمعامل θ وتمثل احتمالية البيانات بعد حساب متوسطها على جميع المعلمات. وبما أن المقام مستقل عن θ ، فإن المقدر البايزي يُحسب عن طريق تعظيمفيما يتعلق بـ θ . إذا افترضنا كذلك أن الافتراض المسبقإذا كان التوزيع منتظمًا، يتم الحصول على المقدر البايزي عن طريق تعظيم دالة الاحتمال.وبالتالي، يتطابق المقدر البايزي مع مقدر الاحتمال الأقصى لتوزيع مسبق منتظم..
تطبيق تقدير الاحتمال الأقصى في نظرية القرار البايزية
في العديد من التطبيقات العملية في مجال التعلم الآلي ، يتم استخدام تقدير الاحتمال الأقصى كنموذج لتقدير المعلمات.
تتمحور نظرية القرار البايزية حول تصميم مصنف يقلل من إجمالي المخاطر المتوقعة، وخاصة عندما تتساوى التكاليف (دالة الخسارة) المرتبطة بالقرارات المختلفة، حيث يقلل المصنف من الخطأ على كامل التوزيع. [ 23 ]
وبالتالي، تُصاغ قاعدة قرار بايز على النحو التالي:
- "يقررلووإلا قرر"
أينهي تنبؤات لفئات مختلفة. ومن منظور تقليل الخطأ، يمكن أيضًا التعبير عنها على النحو التالي: أين إذا قررناوإذا قررنا
بتطبيق نظرية بايز وإذا افترضنا كذلك دالة الخسارة الصفرية أو الواحدة، وهي خسارة متساوية لجميع الأخطاء، فيمكن إعادة صياغة قاعدة قرار بايز على النحو التالي: أينهذا هو التوقع وهو الاحتمال المسبق .
العلاقة بتقليل تباعد كولباك-لايبير والإنتروبيا المتقاطعة
إيجادإن إيجاد القيمة التي تزيد من الاحتمالية يكافئ تقاربياً إيجادالذي يحدد توزيعًا احتماليًا () الذي له مسافة دنيا، من حيث تباعد كولباك-لايبير ، إلى توزيع الاحتمال الحقيقي الذي تم توليد بياناتنا منه (أي، تم توليده بواسطة[ 24 ] في عالم مثالي ، يكون P و Q متساويين (والشيء الوحيد المجهول هوالذي يُحدد P)، ولكن حتى لو لم تكن كذلك وكان النموذج الذي نستخدمه غير دقيق، فإن تقدير الاحتمال الأقصى سيُعطينا التوزيع "الأقرب" (ضمن قيود نموذج Q الذي يعتمد على) إلى التوزيع الحقيقي[ 25 ]
| دليل. |
لتبسيط الترميز، لنفترض أن P=Q. ولنفترض وجود n عينة بيانات مستقلة ومتطابقة.من احتمال معين، التي نحاول تقديرها من خلال إيجادسيؤدي ذلك إلى زيادة احتمالية الاستخدام، ثم: أينيساعد استخدام h في فهم كيفية تطبيق قانون الأعداد الكبيرة للانتقال من متوسط h ( x ) إلى قيمته المتوقعة باستخدام قانون الإحصائي غير الواعي . ترتبط التحولات الأولى بقوانين اللوغاريتمات ، وهذا ما يُفسر إيجادها.إن الدالة التي تحقق أقصى قدر من بعض الدوال ستكون أيضًا هي الدالة التي تحقق أقصى قدر من بعض التحويلات الرتيبة لتلك الدالة (أي: الجمع/الضرب في ثابت). بما أن الإنتروبيا المتقاطعة هي ببساطة إنتروبيا شانون بالإضافة إلى تباعد كولباك-لايبير، وبما أن إنتروبياإذا كانت ثابتة، فإن تقدير الاحتمال الأقصى يقلل أيضًا من الإنتروبيا المتقاطعة بشكل تقاربي. [ 26 ] |
تحيز التنبؤ
يمكن استبدال تقديرات الاحتمال الأقصى للمعلمات في تعابير دالة كثافة الاحتمال ، أو دالة التوزيع التراكمي ، أو دالة الكمية ، لتوليد تنبؤات باحتمالات أو كميات الأحداث خارج العينة. يُوصى بهذه الطريقة للتنبؤ بالاحتمالات في كتب الإحصاء [ 27 ] [ 28 ] [ 29 ] وكتب العلوم الاكتوارية [ 30 ] ، وهي شائعة الاستخدام في الأدبيات العلمية. مع ذلك، يفشل التنبؤ بالاحتمال الأقصى في نقل عدم اليقين المحيط بتقديرات معلمات الاحتمال الأقصى إلى التنبؤ [ 31 ] [ 32 ] . ونتيجةً لذلك، لا تكون الاحتمالات المتوقعة دقيقة ، ولا يُتوقع أن تتطابق مع ترددات الأحداث خارج العينة. على وجه الخصوص، عادةً ما يتم التقليل من احتمالات تجاوز الذيل وكميات تجاوز الذيل، وأحيانًا بشكل كبير. يكون التقليل في أقصى حالاته عندما تكون بيانات التدريب قليلة، وعندما يتم تقدير العديد من المعلمات، وبالنسبة للذيل البعيد. في الحالات التي يُمثل فيها هذا التحيز في التنبؤ مشكلة، يمكن أن توفر التنبؤات البايزية حلاً إذا تم اختيار التوزيع الاحتمالي المسبق بحيث يقلل من التحيز أو يزيله تمامًا. [ 33 ] [ 34 ] [ 35 ]
أمثلة
توزيع منتظم منفصل
لنفترض حالةً وُضِعَت فيها n تذكرة مرقمة من 1 إلى n في صندوق، ثم سُحِبَت واحدة منها عشوائيًا ( انظر التوزيع المنتظم )؛ وبالتالي، يكون حجم العينة 1. إذا كان n غير معروف، فإن مُقدِّر الاحتمال الأقصىيمثل n الرقم m على التذكرة المسحوبة. (الاحتمالية تساوي صفرًا عندما n < m ، وتساوي 1 / n عندما n ≥ m ، وتكون هذه الاحتمالية في أعلى مستوياتها عندما n = m . لاحظ أن تقدير الاحتمالية القصوى لـ n يقع عند الحد الأدنى للقيم الممكنة { m , m + 1, ...}، وليس في مكان ما في "منتصف" نطاق القيم الممكنة، مما يقلل من التحيز). القيمة المتوقعة للرقم m على التذكرة المسحوبة، وبالتالي القيمة المتوقعة لـ ، هو ( ن + 1)/2. ونتيجة لذلك، مع حجم عينة يساوي 1، فإن مقدر الاحتمال الأقصى لـ ن سيقلل بشكل منهجي من قيمة ن بمقدار ( ن - 1)/2.
التوزيع المنفصل، فضاء المعلمات المحدود
لنفترض أننا نرغب في تحديد مدى تحيز عملة معدنية غير عادلة . لنفترض أن احتمال ظهور " صورة " عند رمي العملة هو p . يصبح الهدف حينها هو تحديد قيمة p .
لنفترض أن العملة المعدنية تم رميها 80 مرة: أي أن العينة قد تكون شيئًا مثل x 1 = H، x 2 = T، ...، x 80 = T، ويتم ملاحظة عدد مرات ظهور "H".
احتمالية ظهور الكتابة عند رمي العملة هي 1 − p (حيث p هي θ المذكورة أعلاه). لنفترض أن النتيجة هي 49 صورة و31 كتابة ، ولنفترض أن العملة سُحبت من صندوق يحتوي على ثلاث عملات: واحدة تعطي صورة باحتمالية p = 1/3 ، وأخرى تعطي صورة باحتمالية p = 1/2 ، وثالثة تعطي صورة باحتمالية p = 2/3 . فقدت العملات ملصقاتها، لذا فإن العملة المسحوبة غير معروفة. باستخدام تقدير الاحتمال الأقصى، يمكن إيجاد العملة ذات الاحتمالية الأكبر، بالنظر إلى البيانات المرصودة. باستخدام دالة الكتلة الاحتمالية للتوزيع ذي الحدين مع حجم عينة يساوي 80 ، وعدد نجاحات يساوي 49 ولكن لقيم مختلفة لـ p (احتمالية النجاح)، تأخذ دالة الاحتمال (المعرفة أدناه) إحدى ثلاث قيم:
يتم تعظيم الاحتمالية عندما تكون p = 2 ⁄ 3 ، وبالتالي فإن هذا هو تقدير الاحتمالية القصوى لـ p .
التوزيع المنفصل، فضاء المعلمات المستمر
لنفترض الآن أنه كان هناك عملة واحدة فقط، ولكن احتمالها (p) يمكن أن يكون أي قيمة بين 0 و 1 . دالة الاحتمال التي يجب تعظيمها هي
ويتم تحقيق أقصى قيمة على جميع القيم الممكنة 0 ≤ p ≤ 1.

إحدى طرق زيادة هذه الدالة إلى أقصى حد هي عن طريق الاشتقاق بالنسبة إلى p وجعلها تساوي صفرًا:
هذا ناتج ضرب ثلاثة حدود. الحد الأول يساوي صفرًا عندما تكون قيمة p تساوي صفرًا . الحد الثاني يساوي صفرًا عندما تكون قيمة p تساوي واحدًا. الحد الثالث يساوي صفرًا عندما تكون قيمة p تساوي 49/80 . من الواضح أن الحل الذي يُعظّم الاحتمالية هو p = 49/80 ( لأن p = 0 و p = 1 ينتج عنهما احتمالية تساوي صفرًا). بالتالي، فإن مُقدِّر الاحتمالية القصوى لـ p هو 49/80 .
يمكن تعميم هذه النتيجة بسهولة باستبدال الحرف s مكان 49 لتمثيل عدد "النجاحات" الملحوظة في تجارب برنولي ، والحرف n مكان 80 لتمثيل عدد تجارب برنولي. وبإجراء الحساب نفسه، نحصل على s / n، وهو مُقدِّر الاحتمال الأقصى لأي سلسلة من n تجربة برنولي ينتج عنها s "نجاحًا".
التوزيع المستمر، فضاء المعلمات المستمر
بالنسبة للتوزيع الطبيعيوالتي لها دالة كثافة احتمالية
دالة كثافة الاحتمال المقابلة لعينة من n متغيرات عشوائية طبيعية مستقلة ومتطابقة التوزيع (الاحتمالية) هي
تحتوي هذه المجموعة من التوزيعات على معلَمَين: θ = ( μ , σ ) ؛ لذا فإننا نزيد الاحتمالية إلى أقصى حد.، على كلا المعيارين في وقت واحد، أو بشكل فردي إن أمكن.
بما أن دالة اللوغاريتم نفسها دالة متصلة ومتزايدة تمامًا على مدى دالة الاحتمال، فإن القيم التي تُعظّم دالة الاحتمال ستُعظّم أيضًا لوغاريتمها (دالة الاحتمال اللوغاريتمية نفسها ليست بالضرورة متزايدة تمامًا). ويمكن كتابة دالة الاحتمال اللوغاريتمية على النحو التالي:
(ملاحظة: يرتبط احتمال اللوغاريتم ارتباطًا وثيقًا بإنتروبيا المعلومات ومعلومات فيشر .)
نقوم الآن بحساب مشتقات دالة الاحتمال اللوغاريتمي هذه على النحو التالي.
أينهو متوسط العينة . ويتم حل هذه المسألة بواسطة
هذه هي بالفعل القيمة القصوى للدالة، لأنها نقطة التحول الوحيدة في μ، والمشتقة الثانية أقل من الصفر تمامًا. وقيمتها المتوقعة تساوي قيمة المعامل μ للتوزيع المعطى.
وهذا يعني أن مقدر الاحتمال الأقصىمحايد.
وبالمثل، نقوم بتفاضل دالة الاحتمال اللوغاريتمي بالنسبة إلى σ ونساويها بالصفر:
والتي يتم حلها بواسطة
إدخال التقديرنحصل على
لحساب قيمتها المتوقعة، من الملائم إعادة كتابة التعبير بدلالة المتغيرات العشوائية ذات المتوسط الصفري ( الخطأ الإحصائي ). التعبير عن التقدير بهذه المتغيرات ينتج عنه
بتبسيط العبارة أعلاه، وباستخدام الحقائق التيو، مما يسمح لنا بالحصول
هذا يعني أن المُقدِّرمتحيز لـويمكن أيضاً إثبات أنمتحيز لـلكن كلاهماومتسقة.
بصورة رسمية نقول أن مقدر الاحتمال الأقصى لـيكون
في هذه الحالة، يمكن الحصول على تقديرات الاحتمال الأقصى بشكل فردي. ولكن في الغالب، قد لا يكون هذا هو الحال، وسيتعين الحصول على تقديرات الاحتمال الأقصى في وقت واحد.
يأخذ اللوغاريتم الطبيعي للاحتمالية عند أقصى قيمة له شكلاً بسيطاً للغاية:
يمكن إثبات أن قيمة الاحتمال اللوغاريتمي القصوى هذه هي نفسها بالنسبة لطرق المربعات الصغرى الأكثر عمومية ، حتى بالنسبة لطرق المربعات الصغرى غير الخطية . ويُستخدم هذا غالبًا في تحديد فترات الثقة التقريبية ومناطق الثقة القائمة على الاحتمال ، والتي تكون عمومًا أكثر دقة من تلك التي تستخدم التوزيع الطبيعي التقاربي المذكور أعلاه.
المتغيرات غير المستقلة
قد يكون الأمر أن المتغيرات مترابطة، أو بشكل أعم، غير مستقلة. متغيران عشوائيانوتكون المتغيرات مستقلة فقط إذا كانت دالة كثافة الاحتمال المشتركة بينها هي حاصل ضرب دوال كثافة الاحتمال الفردية، أي
لنفترض أننا نقوم بإنشاء متجه غاوسي من الرتبة n من متغيرات عشوائية.حيث يكون لكل متغير متوسطات معطاة بواسطةعلاوة على ذلك، لنرمز إلى مصفوفة التغاير بـ. ثم تتبع دالة كثافة الاحتمال المشتركة لهذه المتغيرات العشوائية n توزيعًا طبيعيًا متعدد المتغيرات معطى بالصيغة التالية:
في حالة المتغيرين ، تُعطى دالة كثافة الاحتمال المشترك بالصيغة التالية:
في هذه الحالة وغيرها من الحالات التي توجد فيها دالة كثافة مشتركة، يتم تعريف دالة الاحتمال كما هو مذكور أعلاه، في قسم " المبادئ "، باستخدام هذه الكثافة.
مثال
هي أعداد في الخلايا/المربعات من 1 إلى m؛ لكل مربع احتمال مختلف (فكر في المربعات الأكبر أو الأصغر) ونحدد عدد الكرات التي تسقط.:احتمال كل مربع هو، مع وجود قيد:هذه حالة يكون فيهاإذا لم تكن المتجهات مستقلة، فإن الاحتمال المشترك لمتجه مايُطلق عليه اسم متعدد الحدود وله الشكل التالي:
كل مربع على حدة مقابل جميع المربعات الأخرى يمثل توزيعًا ثنائيًا، وهذا امتداد له.
احتمالية حدوث ذلك هي:
يجب أخذ القيد في الاعتبار واستخدام معاملات لاغرانج:
من خلال افتراض أن جميع المشتقات تساوي صفرًا، يتم الحصول على التقدير الأكثر طبيعية
إن تعظيم احتمالية اللوغاريتم، مع وجود قيود وبدونها، يمكن أن يكون مشكلة غير قابلة للحل في شكل مغلق، ثم يتعين علينا استخدام الإجراءات التكرارية.
الإجراءات التكرارية
باستثناء الحالات الخاصة، فإن معادلات الاحتمالية ;\mathbf {y} )}{\partial \theta }}=0}
لا يمكن حلها بشكل صريح للمُقدِّربدلاً من ذلك، يجب حلها بشكل تكراري : بدءًا من تخمين أولي لـ(يقوليسعى المرء إلى الحصول على متتالية متقاربةتتوفر العديد من الطرق لحل هذا النوع من مسائل التحسين ، [ 36 ] [ 37 ] ولكن أكثرها شيوعًا هي الخوارزميات القائمة على صيغة تحديث من الشكل التالي:
حيث المتجهيشير إلى اتجاه هبوط "الخطوة" رقم r ، والقيمة العدديةيلتقط "طول الخطوة"، [ 38 ] [ 39 ] والمعروف أيضًا باسم معدل التعلم . [ 40 ]
طريقة التدرج الهبوطي
(ملاحظة: هنا يتعلق الأمر بمسألة تعظيم، لذا يتم عكس الإشارة قبل التدرج)
هذا صغير بما يكفي للتقارب و
تتطلب طريقة التدرج الهبوطي حساب التدرج في التكرار رقم r ، ولكنها لا تتطلب حساب معكوس المشتقة الثانية، أي مصفوفة هيسيان. لذلك، فهي أسرع حسابيًا من طريقة نيوتن - رافسون.
و
أينهي النتيجة وهي معكوس مصفوفة هيسيان لدالة الاحتمال اللوغاريتمي، وكلاهما يُحسب في التكرار رقم r . [ 41 ] [ 42 ] ولكن نظرًا لأن حساب مصفوفة هيسيان مكلف حسابيًا ، فقد تم اقتراح العديد من البدائل. تقوم خوارزمية بيرندت-هول-هول-هاوسمان الشائعة بتقريب مصفوفة هيسيان بالضرب الخارجي للتدرج المتوقع، بحيث
;\mathbf {y} )}{\partial \theta}}\left({\frac {\partial \ell (\theta ;\mathbf {y} )}{\partial \theta }}\right)^{\mathsf {T}}\right]^{-1}\mathbf {s} _{r}\left({\widehat {\theta }}\right)}
تستخدم طرق شبه نيوتن الأخرى تحديثات قاطع أكثر تفصيلاً لإعطاء تقريب لمصفوفة هيسيان.
تجد صيغة DFP حلاً متناظراً، موجباً تماماً، وأقرب ما يكون إلى القيمة التقريبية الحالية للمشتقة من الدرجة الثانية:
أين
كما أن خوارزمية BFGS تعطي حلاً متناظراً وموجباً تماماً:
أين
لا يُضمن تقارب طريقة BFGS إلا إذا كانت للدالة متسلسلة تايلور تربيعية قريبة من القيمة المثلى. ومع ذلك، يمكن أن تحقق BFGS أداءً مقبولاً حتى في حالات التحسين غير السلسة.
وهناك طريقة شائعة أخرى تتمثل في استبدال مصفوفة هيسيان بمصفوفة معلومات فيشر .وهذا ما يُعطينا خوارزمية تسجيل فيشر. هذا الإجراء قياسي في تقدير العديد من الطرق، مثل النماذج الخطية المعممة .
على الرغم من شيوعها، قد تتقارب طرق شبه نيوتن إلى نقطة ثابتة ليست بالضرورة قيمة عظمى محلية أو عالمية، [ 43 ] بل قد تكون قيمة صغرى محلية أو نقطة سرجية . لذلك، من المهم تقييم صحة الحل المُستنتج لمعادلات الاحتمالية، وذلك بالتحقق من أن مصفوفة هيسيان، المحسوبة عند الحل، سالبة التحديد وجيدة التكييف . [ 44 ]
تاريخ
من أوائل مستخدمي طريقة الاحتمال الأقصى كارل فريدريش غاوس ، وبيير سيمون لابلاس ، وثورفالد ن. ثيل ، وفرانسيس يسيدرو إيدجوورث . [ 45 ] [ 46 ] إلا أن رونالد فيشر هو من ابتكر النسخة الحديثة من هذه الطريقة بمفرده بين عامي 1912 و1922. [ 47 ] [ 48 ]
تجاوز تقدير الاحتمال الأقصى التبرير الاستدلالي في برهان نشره صموئيل س . ويلكس عام 1938، ويُعرف الآن باسم نظرية ويلكس . [ 49 ] تُبين النظرية أن الخطأ في لوغاريتم قيم الاحتمال للتقديرات المُستمدة من مُشاهدات مُستقلة مُتعددة يتبع توزيع χ² تقاربياً، مما يُتيح تحديد منطقة ثقة حول أي تقدير للمعلمات بسهولة . يعتمد الجزء الوحيد الصعب في برهان ويلكس على القيمة المُتوقعة لمصفوفة معلومات فيشر ، والتي تُقدمها نظرية أثبتها فيشر. [ 50 ] واصل ويلكس تحسين عمومية النظرية طوال حياته، ونُشر برهانه الأكثر عمومية عام 1962. [ 51 ]
قدّم عدد من المؤلفين مراجعات لتطور تقدير الاحتمال الأقصى. [ 52 ] [ 53 ] [ 54 ] [ 55 ] [ 56 ] [ 57 ] [ 58 ] [ 59 ]
انظر أيضاً
مفاهيم ذات صلة
- معيار معلومات أكايكي : معيار لمقارنة النماذج الإحصائية، يعتمد على تقدير الاحتمال الأقصى.
- مُقدِّر القيم القصوى : فئة أعمّ من المُقدِّرات التي ينتمي إليها تقدير الاحتمال الأقصى
- معلومات فيشر : مصفوفة المعلومات، وعلاقتها بمصفوفة التغاير لتقديرات الاحتمال الأقصى
- متوسط مربع الخطأ : مقياس لمدى "جودة" مقدر معلمة التوزيع (سواء كان مقدر الاحتمال الأقصى أو أي مقدر آخر).
- RANSAC : طريقة لتقدير معلمات نموذج رياضي بالنظر إلى بيانات تحتوي على قيم متطرفة
- تنص نظرية راو-بلاك ويل على عملية لإيجاد أفضل مُقدِّر غير متحيز ممكن (بمعنى أن يكون متوسط مربع الخطأ فيه في حده الأدنى )؛ وغالبًا ما يكون تقدير الاحتمال الأقصى نقطة انطلاق جيدة لهذه العملية.
- نظرية ويلكس : توفر وسيلة لتقدير حجم وشكل منطقة التقديرات ذات الاحتمالات المتساوية تقريبًا لقيم معلمات المجتمع، باستخدام المعلومات المستقاة من عينة واحدة، باستخدام توزيع كاي تربيع.
طرق تقدير أخرى
- طريقة العزوم المعممة : طرق متعلقة بمعادلة الاحتمالية في تقدير الاحتمالية القصوى
- المُقدِّر M : منهج يُستخدم في الإحصاءات القوية
- مقدِّر الاحتمال اللاحق الأقصى (MAP): للمقارنة بين طريقة حساب المقدرات عند افتراض المعرفة المسبقة
- تقدير أقصى مسافة بين العناصر : طريقة ذات صلة تتميز بمتانتها في العديد من الحالات
- تقدير أقصى إنتروبيا
- طريقة العزوم (الإحصاء) : طريقة شائعة أخرى لإيجاد معلمات التوزيعات
- طريقة الدعم ، وهي شكل من أشكال تقنية الاحتمال الأقصى
- تقدير المسافة الدنيا
- أساليب الاحتمالية الجزئية لبيانات اللوحات
- مُقدِّر شبه الاحتمال الأقصى : مُقدِّر احتمال أقصى غير مُحدَّد بشكل صحيح، ولكنه لا يزال متسقًا
- الاحتمال الأقصى المقيد : هو شكل معدل يستخدم دالة احتمال محسوبة من مجموعة بيانات مُحوَّلة.
مراجع
- ↑ روسي، ريتشارد ج. (2018). الإحصاء الرياضي: مقدمة في الاستدلال القائم على الاحتمالية . نيويورك: جون وايلي وأولاده. ص 227. ISBN 978-1-118-77104-4.
- ↑ هندري، ديفيد ف .؛ نيلسن، بنت (2007). النمذجة الاقتصادية القياسية: منهج الاحتمالية . برينستون: مطبعة جامعة برينستون. ISBN 978-0-691-13128-3.
- ↑ تشامبرز، ريموند ل.؛ ستيل، ديفيد ج.؛ وانغ، سوجين؛ ويلش، آلان (2012). تقدير الاحتمال الأقصى للمسح العيني . بوكا راتون: مطبعة سي آر سي. رقم ISBN 978-1-58488-632-7.
- ↑ وارد، مايكل دون ؛ ألكويست، جون س. (2018). أقصى احتمال للعلوم الاجتماعية: استراتيجيات التحليل . نيويورك: مطبعة جامعة كامبريدج. ISBN 978-1-107-18582-1.
- ↑ بريس، دبليو إتش؛ فلانري، بي بي؛ تيوكولسكي، إس إيه؛ فيترلينغ، دبليو تي (1992). "المربعات الصغرى كمُقدِّر أقصى احتمال" . وصفات عددية في فورتران: فن الحوسبة العلمية ( الطبعة الثانية). كامبريدج: مطبعة جامعة كامبريدج. الصفحات 651-655 . ISBN 0-521-43064-X.
- ↑ ميونغ، آي جيه (2003). "دليل تعليمي حول تقدير الاحتمال الأقصى". مجلة علم النفس الرياضي . 47 (1): 90-100 . doi : 10.1016/S0022-2496(02)00028-7 .
- ↑ غورييرو ، كريستيان؛ مونفور، آلان (1995). نماذج الإحصاء والاقتصاد القياسي . مطبعة جامعة كامبريدج. ص 161. ISBN 0-521-40551-3.
- ↑ كين، إدوارد ج. (1968). الإحصاءات الاقتصادية والاقتصاد القياسي . نيويورك، نيويورك: هاربر آند رو. ص 179 .
- ↑ سمول، كريستوفر ج.؛ وانغ، جينفانغ (2003). "العمل مع الجذور" . الطرق العددية لمعادلات التقدير غير الخطية . مطبعة جامعة أكسفورد. ص 74-124 . ISBN 0-19-850688-0.
- ↑ كاس، روبرت إي.؛ فوس، بول دبليو. (1997). الأسس الهندسية للاستدلال التقاربي . نيويورك، نيويورك: جون وايلي وأولاده. ص 14. ISBN 0-471-82668-5.
- ↑ بابادوبولوس، أليكوس (25 سبتمبر 2013). "لماذا نضع دائمًا دالة اللوغاريتم (log()) قبل دالة كثافة الاحتمال المشتركة عند استخدام تقدير الاحتمال الأقصى (MLE)؟" . ستاك إكستشينج .
- 1 2 سيلفي، إس دي (1975). الاستدلال الإحصائي . لندن، المملكة المتحدة: تشابمان وهول. ص 79. ISBN 0-412-13820-4.
- ↑ أوليف، ديفيد (2004). "هل تُعظّم طريقة الاحتمال الأقصى الاحتمالية؟" (ملف PDF) . جامعة جنوب إلينوي .
- ↑ شوالي، دانيال ب. (1985). "مُقدِّرات التغاير ذات الاحتمالية القصوى الموجبة المحددة". رسائل اقتصادية . 17 ( 1-2 ): 115-117 . doi : 10.1016/0165-1765(85)90139-9 .
- ↑ ماغنوس، جان ر. (2017). مقدمة في نظرية الاقتصاد القياسي . أمستردام: مطبعة جامعة VU. ص 64-65 . ISBN 978-90-8659-766-6.
- ↑ إدواردز، أ. و. ف. 1972. الاحتمالية. مطبعة جامعة كامبريدج، كامبريدج (طبعة موسعة، 1992، مطبعة جامعة جونز هوبكنز، بالتيمور). ISBN 0-8018-4443-6
- ↑ Pfanzagl (1994 ، ص 206)
- ↑ وفقًا للنظرية 2.5 في نيوي، ويتني ك.؛ مكفادين، دانيال (1994). "الفصل 36: تقدير العينات الكبيرة واختبار الفرضيات". في إنجل، روبرت؛ مكفادين، دان (محرران). دليل الاقتصاد القياسي، المجلد 4. إلسيفير ساينس. الصفحات 2111-2245 . ISBN 978-0-444-88766-5.
- ١ ٢ وفقًا للنظرية ٣.٣ في نيوي، ويتني ك.؛ مكفادين، دانيال (١٩٩٤). "الفصل ٣٦: تقدير العينات الكبيرة واختبار الفرضيات". في إنجل، روبرت؛ مكفادين، دان (محرران). دليل الاقتصاد القياسي، المجلد ٤. إلسيفير ساينس. الصفحات ٢١١١-٢٢٤٥ . ISBN 978-0-444-88766-5.
- ↑ زاكس، شيليمياهو (1971). نظرية الاستدلال الإحصائي . نيويورك: جون وايلي وأولاده. ص 223. ISBN 0-471-98103-6.
- ↑ انظر الصيغة 20 في: كوكس، ديفيد ر .؛ سنيل، إي. جويس (1968). "تعريف عام للبواقي". مجلة الجمعية الإحصائية الملكية، السلسلة ب . 30 (2): 248-275 . doi : 10.1111/j.2517-6161.1968.tb00724.x . JSTOR 2984505 .
- ↑ كانو، يوتاكا (1996). "الكفاءة من الدرجة الثالثة تعني الكفاءة من الدرجة الرابعة" . مجلة الجمعية الإحصائية اليابانية . 26 : 101-117 . doi : 10.14490/jjss1995.26.101 .
- ↑ كريستنسن، هنريكت آي. "التعرف على الأنماط" (ملف PDF) (محاضرة). نظرية القرار البايزية - CS 7616. معهد جورجيا للتكنولوجيا.
- ↑ cmplx96 ( https://stats.stackexchange.com/users/177679/cmplx96 )، تباعد كولباك-لايبير، الرابط (الإصدار: 2017-11-18): https://stats.stackexchange.com/q/314472 (في فيديو يوتيوب، انظر من الدقيقة 13 إلى 25)
- ↑ مقدمة في الاستدلال الإحصائي | ستانفورد (المحاضرة 16 - تقدير الاحتمال الأقصى في ظل سوء تحديد النموذج)
- ↑ يقول سايكوراكس: أعيدوا مونيكا ( https://stats.stackexchange.com/users/22311/sycorax-says-reinstate-monica )، العلاقة بين تعظيم الاحتمالية وتقليل الإنتروبيا المتقاطعة، الرابط (الإصدار: 2019-11-06): https://stats.stackexchange.com/q/364237
- ↑ كولز، ستيوارت (2001). مقدمة في النمذجة الإحصائية للقيم المتطرفة . سلسلة سبرينغر في الإحصاء. doi : 10.1007/978-1-4471-3675-0 . ISBN 978-1-84996-874-4ISSN 0172-7397
- ↑ التحليل الإحصائي للقيم المتطرفة . 2007. doi : 10.1007/978-3-7643-7399-3 . ISBN 978-3-7643-7230-9.
- ^ امبريشتس، بول. كلوبلبيرج، كلوديا؛ ميكوش، توماس (1997). نمذجة الأحداث المتطرفة . دوى : 10.1007/978-3-642-33483-2 . رقم ISBN 978-3-642-08242-9.
- ↑ نماذج الخسارة . سلسلة وايلي في الاحتمالات والإحصاء. 2013. doi : 10.1002/9781118787106 . ISBN 978-1-118-34356-2.
- ↑ جيرارد، ر.؛ تساناكاس، أ. (2011). "احتمالية الفشل في ظل عدم اليقين في المعلمات" . تحليل المخاطر . 31 (5): 727-744 . Bibcode : 2011RiskA..31..727G . doi : 10.1111/j.1539-6924.2010.01549.x . ISSN 1539-6924 . PMID 21175720 .
- ↑ جويسون، ستيفن؛ سويتينغ، تريفور؛ جويسون، لين (2025-02-20). "الحد من تحيز الموثوقية في تقييمات مخاطر الطقس المتطرف باستخدام معايرة المعلومات المسبقة" . التقدم في علم المناخ الإحصائي والأرصاد الجوية وعلم المحيطات . 11 (1): 1-22 . Bibcode : 2025ASCMO..11....1J . doi : 10.5194/ascmo-11-1-2025 . ISSN 2364-3579 .
- ↑ سيفيريني، توماس أ.؛ موكيرجي، راهول؛ غوش، مالاي (1 ديسمبر 2002). "حول خاصية مطابقة الاحتمالية الدقيقة للتوزيعات الاحتمالية المسبقة الثابتة من اليمين" . Biometrika . 89 (4): 952–957 . doi : 10.1093/biomet/89.4.952 . ISSN 0006-3444 .
- ↑ جيرارد، ر.؛ تساناكاس، أ. (2011). "احتمالية الفشل في ظل عدم اليقين في المعلمات" . تحليل المخاطر . 31 (5): 727-744 . Bibcode : 2011RiskA..31..727G . doi : 10.1111/j.1539-6924.2010.01549.x . ISSN 1539-6924 . PMID 21175720 .
- ↑ جويسون، ستيفن؛ سويتينغ، تريفور؛ جويسون، لين (2025-02-20). "الحد من تحيز الموثوقية في تقييمات مخاطر الطقس المتطرف باستخدام معايرة المعلومات المسبقة" . التقدم في علم المناخ الإحصائي والأرصاد الجوية وعلم المحيطات . 11 (1): 1-22 . Bibcode : 2025ASCMO..11....1J . doi : 10.5194/ascmo-11-1-2025 . ISSN 2364-3579 .
- ↑ فليتشر، ر. (1987). الأساليب العملية للتحسين ( الطبعة الثانية). نيويورك، نيويورك: جون وايلي وأولاده. ISBN 0-471-91547-5.
- ↑ نوسيدال، خورخي ؛ رايت، ستيفن ج. (2006). التحسين العددي ( الطبعة الثانية). نيويورك، نيويورك: سبرينغر. ISBN 0-387-30303-0.
- ↑ داغانزو، كارلوس (1979). نموذج بروبيت متعدد الحدود: النظرية وتطبيقها على التنبؤ بالطلب . نيويورك: أكاديميك برس. ص 61-78 . ISBN 0-12-201150-3.
- ↑ غولد، ويليام؛ بيتبلادو، جيفري؛ بوي، برايان (2010). تقدير الاحتمال الأقصى باستخدام ستاتا ( الطبعة الرابعة). كوليدج ستيشن: ستاتا برس. الصفحات 13-20 . ISBN 978-1-59718-078-8.
- ↑ مورفي، كيفن ب. (2012). تعلم الآلة: منظور احتمالي . كامبريدج: مطبعة معهد ماساتشوستس للتكنولوجيا. ص 247. ISBN 978-0-262-01802-9.
- ↑ أميميا، تاكيشي (1985). الاقتصاد القياسي المتقدم . كامبريدج: مطبعة جامعة هارفارد. ص 137-138 . ISBN 0-674-00560-0.
- ↑ سارجان، دينيس (1988). "أساليب التحسين العددي". محاضرات في نظرية الاقتصاد القياسي المتقدمة . أكسفورد: باسل بلاكويل. ص 161-169 . ISBN 0-631-14956-2.
- ↑ انظر النظرية 10.1 في كتاب أفرييل، موردخاي (1976). البرمجة غير الخطية: التحليل والأساليب . إنجلوود كليفس، نيوجيرسي: برنتيس هول. الصفحات 293-294 . ISBN 978-0-486-43227-4.
- ↑ جيل، فيليب إي.؛ موراي، والتر؛ رايت، مارغريت هـ. (1981). التحسين العملي . لندن، المملكة المتحدة: أكاديميك برس. ص 312-313 . ISBN 0-12-283950-1.
- ↑ إيدجوورث، فرانسيس ي. (سبتمبر 1908). "حول الأخطاء المحتملة لثوابت التردد" . مجلة الجمعية الإحصائية الملكية . 71 (3): 499-512 . doi : 10.2307/2339293 . JSTOR 2339293 .
- ↑ إيدجوورث، فرانسيس ي. (ديسمبر 1908). "حول الأخطاء المحتملة لثوابت التردد" . مجلة الجمعية الإحصائية الملكية . 71 (4): 651-678 . doi : 10.2307/2339378 . JSTOR 2339378 .
- ^ بفانزاجل، يوهان (1994). النظرية الإحصائية البارامترية . والتر دي جرويتر . ص 207 – 208. دوى : 10.1515 / 9783110889765 . رقم ISBN 978-3-11-013863-4MR 1291393
- ↑ هالد، أندرس (1999). "حول تاريخ الاحتمال الأقصى وعلاقته بالاحتمال العكسي والمربعات الصغرى" . العلوم الإحصائية . 14 (2): 214-222 . doi : 10.1214/ss/1009212248 . ISSN 0883-4237 . JSTOR 2676741 .
- ↑ ويلكس، إس إس (1938). "توزيع العينة الكبيرة لنسبة الاحتمال لاختبار الفرضيات المركبة" . حوليات الإحصاء الرياضي . 9 : 60-62 . doi : 10.1214/aoms/1177732360 .
- ↑ أوين، آرت ب. (2001). الاحتمالية التجريبية . لندن، المملكة المتحدة؛ بوكا راتون، فلوريدا: تشابمان وهول؛ مطبعة سي آر سي. رقم ISBN 978-1-58488-071-4.
- ↑ ويلكس، صموئيل س. (1962). الإحصاء الرياضي . نيويورك، نيويورك: جون وايلي وأولاده. ISBN 978-0-471-94650-2.
{{cite book}}عدم توافق رقم ISBN / التاريخ ( مساعدة ) - ↑ سافاج، ليونارد ج. (1976). "حول إعادة قراءة آر إيه فيشر" . حوليات الإحصاء . 4 (3): 441-500 . doi : 10.1214/aos/1176343456 . JSTOR 2958221 .
- ↑ برات، جون دبليو. (1976). "إف واي إيدجوورث وآر إيه فيشر حول كفاءة تقدير الاحتمال الأقصى" . حوليات الإحصاء . 4 (3): 501-514 . doi : 10.1214/aos/1176343457 . JSTOR 2958222 .
- ↑ ستيجلر، ستيفن م. (1978). "فرانسيس يسيدرو إيدجوورث، إحصائي". مجلة الجمعية الإحصائية الملكية، السلسلة أ . 141 (3): 287-322 . doi : 10.2307/2344804 . JSTOR 2344804 .
- ↑ ستيجلر، ستيفن م. (1986). تاريخ الإحصاء: قياس عدم اليقين قبل عام 1900. مطبعة جامعة هارفارد. ISBN 978-0-674-40340-6.
- ↑ ستيجلر، ستيفن م. (1999). الإحصاءات على الطاولة: تاريخ المفاهيم والأساليب الإحصائية . مطبعة جامعة هارفارد. ISBN 978-0-674-83601-3.
- ↑ هالد، أندرس (1998). تاريخ الإحصاء الرياضي من 1750 إلى 1930. نيويورك، نيويورك: وايلي. ISBN 978-0-471-17912-2.
- ↑ هالد، أندرس (1999). "حول تاريخ الاحتمال الأقصى وعلاقته بالاحتمال العكسي والمربعات الصغرى" . العلوم الإحصائية . 14 (2): 214-222 . doi : 10.1214/ss/1009212248 . JSTOR 2676741 .
- ↑ ألدريتش، جون (1997). "آر إيه فيشر ونشأة طريقة الاحتمال الأقصى 1912-1922" . العلوم الإحصائية . 12 (3): 162-176 . doi : 10.1214/ss/1030037906 . MR 1617519 .
للمزيد من القراءة
- كريمر، جيه إس (1986). التطبيقات الاقتصادية القياسية لطرق الاحتمال الأقصى . نيويورك، نيويورك: مطبعة جامعة كامبريدج. ISBN 0-521-25317-9.
- إلياسون، سكوت ر. (1993). تقدير الاحتمال الأقصى: المنطق والتطبيق . نيوبري بارك: سيج. ISBN 0-8039-4107-2.
- كينغ، غاري (1989). توحيد المنهجية السياسية: نظرية الاحتمالية للاستدلال الإحصائي . مطبعة جامعة كامبريدج. ISBN 0-521-36697-6.
- لو كام، لوسيان (1990). "الاحتمال الأقصى: مقدمة". مجلة ISI Review . 58 (2): 153-171 . doi : 10.2307/1403464 . JSTOR 1403464 .
- ماغنوس، جان ر. (2017). "الاحتمال الأقصى". مقدمة في نظرية الاقتصاد القياسي . أمستردام، هولندا: مطبعة جامعة VU. ص 53-68 . ISBN 978-90-8659-766-6.
- ميلار، راسل ب. (2011). تقدير الاستدلال باستخدام طريقة الاحتمال الأقصى . هوبوكين، نيوجيرسي: وايلي. ISBN 978-0-470-09482-2.
- بيكلز، أندرو (1986). مقدمة في تحليل الاحتمالية . نورويتش: دبليو إتش هاتشينز وأولاده. ISBN 0-86094-190-6.
- سيفيريني، توماس أ. (2000). أساليب الاحتمال في الإحصاء . نيويورك، نيويورك: مطبعة جامعة أكسفورد. ISBN 0-19-850650-3.
- وارد، مايكل د.؛ ألكويست، جون س. (2018). أقصى احتمال للعلوم الاجتماعية: استراتيجيات التحليل . مطبعة جامعة كامبريدج. ISBN 978-1-316-63682-4.
روابط خارجية
- تيليفيك، أندرياس (2022). أقصى احتمال مقابل المربعات الصغرى في الانحدار الخطي (فيديو)
- "طريقة الاحتمال الأقصى" ، موسوعة الرياضيات ، دار نشر EMS، 2001 [1994]
- بورسل، س. "تقدير الاحتمال الأقصى" . مؤرشف من الأصل بتاريخ 27-10-2019 . تم الاسترجاع بتاريخ 24-04-2007 .
- سارجنت، توماس ؛ ستاشورسكي، جون. "تقدير الاحتمال الأقصى" . الاقتصاد الكمي باستخدام بايثون .
- توميت ، أوت. هينينغسن ، آرني (2019/05/19). "maxLik: حزمة لتقدير الاحتمالية القصوى في R" .
- ليسر، لورانس م. (2007). "كلمات أغنية "MLE" . العلوم الرياضية / كلية العلوم. جامعة تكساس . إل باسو، تكساس . تم الاطلاع بتاريخ 6 مارس 2021 .
- تقدير الاحتمال الأقصى
- مقدرات M
- ملاءمة توزيع الاحتمالات
