البحث الموحد
يسترجع البحث الموحد المعلومات من مصادر متعددة عبر تطبيق بحث مبني على محرك بحث واحد أو أكثر. [ 1 ] يُرسل المستخدم طلب استعلام واحد يُوزع على محركات البحث وقواعد البيانات أو محركات الاستعلام الأخرى المشاركة في النظام الموحد. ثم يجمع البحث الموحد النتائج الواردة من محركات البحث لعرضها على المستخدم. يُمكن استخدام البحث الموحد لدمج مصادر المعلومات المتباينة داخل مؤسسة كبيرة واحدة ("مؤسسة") أو على مستوى شبكة الإنترنت بأكملها.
يتطلب البحث الموحد، على عكس البحث الموزع، تنسيقًا مركزيًا للموارد القابلة للبحث. ويشمل ذلك تنسيق الاستعلامات المرسلة إلى محركات البحث الفردية ودمج نتائج البحث التي تُرجعها كل منها.
غاية
ظهر البحث الموحد لتلبية الحاجة إلى البحث في مصادر محتوى متعددة ومتباينة باستخدام استعلام واحد. يتيح هذا للمستخدم البحث في قواعد بيانات متعددة في وقت واحد وبشكل فوري، وترتيب النتائج من قواعد البيانات المختلفة في شكل مفيد، ثم عرض النتائج للمستخدم.
لذا، يُعدّ البحث الموحد نهجًا لتجميع المعلومات أو دمجها، إذ يوفر نقطة وصول واحدة إلى العديد من مصادر المعلومات، ويعيد البيانات عادةً بصيغة موحدة أو متجانسة جزئيًا. تشمل المناهج الأخرى إنشاء مستودع بيانات مؤسسي ، أو بحيرة بيانات ، أو مركز بيانات . يستعلم البحث الموحد عن البيانات عدة مرات وبطرق متعددة (يتم الاستعلام عن كل مصدر على حدة)، بينما تستورد المناهج الأخرى البيانات وتحوّلها عدة مرات، عادةً في عمليات دفعية ليلية. يوفر البحث الموحد عرضًا فوريًا لجميع المصادر (طالما أنها جميعًا متصلة بالإنترنت ومتاحة).
في محركات البحث الصناعية، مثل لينكدإن ، يُستخدم البحث الموحد لتخصيص تفضيلات البحث الرأسية للاستعلامات غير الواضحة. [ 2 ] على سبيل المثال، عندما يُدخل المستخدم استعلامًا مثل "التعلم الآلي" على لينكدإن، فقد يقصد البحث عن أشخاص يمتلكون مهارات في التعلم الآلي، أو وظائف تتطلب هذه المهارات، أو محتوى حول هذا الموضوع. في مثل هذه الحالات، يمكن للبحث الموحد استغلال نية المستخدم (مثل التوظيف، أو البحث عن وظيفة، أو استهلاك المحتوى) لتخصيص ترتيب النتائج الرأسية لكل مستخدم على حدة.
عملية
كما وصفها بيتر جاكسو، [ 3 ] يتكون البحث الموحد من
- تحويل الاستعلام وبثه إلى مجموعة من قواعد البيانات المتباينة أو موارد الويب الأخرى، باستخدام الصيغة المناسبة،
- دمج النتائج التي تم جمعها من قواعد البيانات،
- تقديمها بتنسيق موجز وموحد مع الحد الأدنى من التكرار، و
- توفير وسيلة، يتم تنفيذها إما تلقائيًا أو بواسطة مستخدم البوابة، لفرز مجموعة النتائج المدمجة.
تُجري بوابات البحث الموحدة، سواءً التجارية أو المفتوحة ، عمليات بحث في قواعد البيانات الببليوغرافية المتاحة للجمهور ، وفهارس المكتبات الإلكترونية المتاحة للجمهور ( OPACs )، ومحركات البحث على الإنترنت مثل جوجل ، و/أو مجموعات البيانات المفتوحة، الحكومية منها والمؤسسية. تُرسل هذه المصادر المعلوماتية قائمة بنتائج البحث إلى واجهة البوابة، حيث يمكن للمستخدم مراجعتها. بعض البوابات تكتفي باستخراج نتائج البحث من قاعدة البيانات دون السماح للمستخدم بالدخول مباشرةً إلى تطبيق مصدر المعلومات. أما البوابات الأكثر تطورًا، فتُزيل التكرارات من قائمة النتائج بدمجها وحذفها. تتوفر ميزات إضافية في العديد من البوابات، لكن الفكرة الأساسية واحدة: تحسين دقة وملاءمة عمليات البحث، وتقليل الوقت اللازم للبحث عن الموارد.
تتيح هذه العملية للبحث الموحد مزايا رئيسية مقارنةً بمحركات البحث الحالية القائمة على برامج الزحف. لا يفرض البحث الموحد أي متطلبات أو أعباء على مالكي مصادر المعلومات الفردية، باستثناء التعامل مع زيادة حجم الزيارات. وتتميز عمليات البحث الموحد بحداثتها، إذ تُجرى في الوقت الفعلي، تمامًا مثل مصادر المعلومات الفردية.
تطبيق

يُعد محرك البحث الفائق أحد تطبيقات البحث الموحد . مع ذلك، لا يتغلب هذا النهج على أوجه القصور في محركات البحث المكونة له، كالفهارس غير المكتملة. تُشكل المستندات غير المفهرسة بواسطة محركات البحث ما يُعرف بالويب العميق أو الويب الخفي. يُعد جوجل سكولار مثالًا واحدًا من بين العديد من المشاريع التي تسعى لمعالجة هذه المشكلة، من خلال فهرسة المستندات الإلكترونية التي تتجاهلها محركات البحث. ويعمل نهج البحث الفائق، كتقنية محركات البحث الأساسية، فقط مع مصادر المعلومات المخزنة إلكترونيًا.
يُعدّ ضمان توافق استعلام البحث مع محركات البحث المُدمجة أحد أبرز تحديات البحث الفائق. فعندما يختلف مُفردات البحث أو نموذج بيانات نظام البحث عن نموذج بيانات واحد أو أكثر من أنظمة البحث المُستهدفة، يجب ترجمة الاستعلام إلى كل نظام من هذه الأنظمة. يُمكن تحقيق ذلك باستخدام ترجمة بسيطة لعناصر البيانات، أو قد يتطلب ترجمة دلالية . على سبيل المثال، إذا كان أحد محركات البحث يسمح باقتباس السلاسل النصية أو الجمل المُتتابعة (n-grams) بدقة، بينما لا يسمح بذلك محرك بحث آخر، فيجب ترجمة الاستعلام ليكون متوافقًا مع كل محرك بحث. ولترجمة استعلام عن سلسلة نصية مُقتَبَرة بدقة، يُمكن تقسيمه إلى مجموعة من الجمل المُتتابعة المُتداخلة (n-grams) التي يُرجّح أن تُعطي نتائج البحث المطلوبة في كل محرك بحث.
يُعدّ التوسع أحد التحديات التي تواجه تطبيق محركات البحث الموحدة. فمن الصعب الحفاظ على أداء محرك البحث الموحد وسرعة استجابته مع ازدياد عدد مصادر المعلومات التي يجمعها. ومن بين تطبيقات البحث الموحد التي بدأت بمعالجة هذه المشكلة، منصة WorldWideScience ، التي يستضيفها مكتب المعلومات العلمية والتقنية التابع لوزارة الطاقة الأمريكية . تتألف WorldWideScience [ 4 ] من أكثر من 40 مصدرًا للمعلومات، العديد منها عبارة عن بوابات بحث موحدة. ومن هذه البوابات Science.gov [ 5 ] ، التي تجمع بدورها أكثر من 30 مصدرًا للمعلومات تمثل معظم مخرجات البحث والتطوير للحكومة الفيدرالية الأمريكية. تُعيد Science.gov نتائجها الأعلى تصنيفًا إلى WorldWideScience، التي بدورها تدمج هذه النتائج مع نتائج البحث التي تُعيدها مصادر المعلومات الأخرى المكونة لـ WorldWideScience، ثم تُصنّفها [ 5 ] . يُمكّن هذا النهج من البحث الموحد المتتالي من البحث في عدد كبير من مصادر المعلومات عبر استعلام واحد.
تطبيق Sesam آخر ، يعمل في كل من النرويج والسويد، مبني على منصة مفتوحة المصدر متخصصة في حلول البحث الموحد. Sesat، [ 6 ] وهو اختصار لـ Sesam Search Application Toolkit ، عبارة عن منصة توفر معظم الإطار والوظائف اللازمة للتعامل مع عمليات البحث المتوازية والمتسلسلة وعرضها بشكل أنيق في واجهة مستخدم، مما يسمح للمهندسين بالتركيز على ضبط إعدادات الفهرس/قاعدة البيانات.
لتخصيص الترتيبات الرأسية في البحث الموحد، يستغل محرك بحث LinkedIn [ 2 ] ملف تعريف الباحث وأنشطته الأخيرة لاستنتاج نيته، مثل التوظيف والبحث عن وظيفة واستهلاك المحتوى، ثم يستخدم النية، إلى جانب العديد من الإشارات الأخرى، لترتيب الترتيبات الرأسية ذات الصلة الشخصية بالباحث الفردي.
محرك البحث SWIRL [ 7 ] هو محرك بحث موحد مفتوح المصدر، تم إصداره بموجب ترخيص Apache 2.0. يتضمن موصلات جاهزة لمحركات البحث مفتوحة المصدر الشائعة، ويعيد ترتيب النتائج باستخدام تشابه متجه جيب التمام.
التحديات
تُشكّل عمليات البحث الموحدة عدداً من التحديات الهامة، مقارنةً بعمليات البحث التقليدية أحادية المصدر:
1. إقرار أوراق الاعتماد
عند إجراء بحث موحد على مصادر بيانات آمنة، يجب تمرير بيانات اعتماد المستخدمين إلى كل محرك بحث أساسي، وذلك للحفاظ على مستوى الأمان المناسب. إذا كان لدى المستخدم بيانات اعتماد تسجيل دخول مختلفة لأنظمة مختلفة، فيجب أن تكون هناك وسيلة لربط معرّف تسجيل الدخول الخاص به بنطاق الأمان الخاص بكل محرك بحث. [ 8 ]
2. تحويل عناصر التنقل في قوائم النتائج إلى نموذج مشترك
لنفترض أننا نبحث في ثلاثة مواقع عقارية، يقدم كل منها قائمة بأسماء المدن المرتبطة بروابط تشعبية، بحيث يمكن النقر على كل رابط لعرض النتائج في تلك المدينة فقط. من الناحية المثالية، يُفضّل دمج هذه الجوانب في مجموعة واحدة، لكن ذلك يطرح تحديات تقنية إضافية. [ 9 ] كما يحتاج النظام إلى فهم روابط "الصفحة التالية" لتمكين المستخدم من تصفح النتائج المدمجة.
يمكن التغلب على جزء من هذا التحدي المتمثل في ربط البيانات بنموذج موحد إذا دعمت الموارد الموحدة البيانات المفتوحة المرتبطة عبر RDF . ويمكن إضافة قواعد (أو أنطولوجيات) لربط النتائج بنماذج موحدة باستخدام هذه التقنية.
3. فرز النتائج وتقييمها
لكل موقع ويب مفهومه الخاص لدرجة الصلة، وقد يدعم بعض ترتيبات النتائج. وتختلف الصلة اختلافًا كبيرًا بين المواقع المشاركة في البحث، لذا فإن معرفة كيفية دمج النتائج لعرض الأكثر صلة أمر صعب أو مستحيل.
4. استعلام قوي
قد يضطر البحث الموحد إلى الاقتصار على الحد الأدنى من إمكانيات الاستعلام المشتركة بين جميع المواقع الموحدة. على سبيل المثال، إذا كان جوجل يدعم النفي والعبارات المقتبسة، بينما لا يدعمها موقع science.gov، فسيكون من المستحيل على البحث الموحد دعم العبارات المنفية والمقتبسة.
5. التوافر والمهلة الزمنية
مع ازدياد عدد المصادر الموحدة، يرتفع احتمال وجود مصدر أو أكثر بطيء أو غير متصل. ويتعين على نظام البحث الموحد تحديد متى يعتبر المصدر غير متصل، أو متى ينتظر استجابة بطيئة. وتُحدد أوقات الاستجابة بناءً على أبطأ مصدر في المجموعة.
6. التطوير والاختبار داخل المؤسسة (مقابل الإنترنت العام)
لا ينبغي لفرق التطوير عادةً إجراء اختبارات تحميل مكثفة على أنظمة الإنتاج أثناء قيامها بأعمالها الروتينية. كما أن بعض الموارد محمية، ولا ينبغي الاستعلام عنها أو كشفها بشكل عشوائي أثناء التطوير حفاظًا على الخصوصية والأمان. لذا، يجب أن تتضمن بيئات التطوير والاختبار واختبار الأداء تثبيت وتكوين العديد من الأنظمة الفرعية لضمان إجراء اختبارات آمنة وموثوقة.
7. HA/DR ( التوافر العالي والتعافي من الكوارث )
لكي يكون النظام الموحد ككل عالي التوفر/متعافي من الكوارث، قد يحتاج كل نظام فرعي إلى أن يكون عالي التوفر/متعافي من الكوارث.
وبالمثل، يتطلب نمذجة الأداء وتخطيط القدرات للنظام الموحد نمذجة وتخطيط وتوسيع جميع الاتحادات في بعض الأحيان.
لكل الأسباب المذكورة أعلاه، قد يكون استخدام مركز بيانات أو بحيرة بيانات ، أو اتباع نهج هجين، هو الخيار الأمثل داخل المؤسسة. تُسهّل مراكز البيانات وبحيرات البيانات عملية التطوير والوصول إليها، ولكنها قد تتطلب بعض التأخير قبل توفر البيانات (بدون منطق مزامنة خاص). أما على الويب، فيُعدّ نظام الاتحاد هو الأكثر شيوعًا.
انظر أيضاً
مراجع
- ↑ "ما هو البحث الموحد؟" . مدونة كوفيو . كوفيو. 16 يونيو 2020. تم الاطلاع عليه في 29 يونيو 2020 .
- 1 2 آريا، دروف؛ ها-ثوك، فييت؛ سينها، شاكتي (2015). "البحث الموحد المخصص على لينكدإن". وقائع المؤتمر الدولي الرابع والعشرين لجمعية الحوسبة الآلية (ACM) حول إدارة المعلومات والمعرفة (CIKM) . الصفحات 1699-1702 . arXiv : 1602.04924 . doi : 10.1145/2806416.2806615 . ISBN 9781450337946.
- ↑ أفكار حول البحث الموحد. جاكسو، بيتر، مجلة المعلومات اليوم، أكتوبر 2004، المجلد 21، العدد 9
- ↑ العلوم العالمية
- 1 2 Science.gov
- ↑ "سيسات" . مؤرشف من الأصل بتاريخ 20 يوليو 2015. تم الاطلاع عليه بتاريخ 17 أغسطس 2019 .
- ↑ "بحث دوامي" . جيت هاب . تم الاسترجاع في 2022-09-08 .
- ↑ ربط متطلبات الأمان بالبحث المؤسسي
- ↑ أكثر من 20 فرقًا بين البحث عبر الإنترنت والبحث المؤسسي - الجزء الأول
للمزيد من القراءة
- البحث الموحد 101. لينوسكي، أليكسيس، والتشيك، تاين، مجلة المكتبات، صيف 2008، نت كونكت، المجلد 133. تم نقل هذا المحتوى إلى هنا ، ولكنك ستحتاج إلى حساب وصول عن بُعد من خلال مكتبتك المحلية للحصول على المقالة كاملة.
- كوكس، كريستوفر ن. البحث الموحد: حل أم انتكاسة لخدمات المكتبات الإلكترونية. بينغامتون، نيويورك: دار هاوورث للمعلومات، 2007. جدول المحتويات
- مقدمة في البحث الموحد. ليدرمان، س.، محركات البحث البديلة، يناير 2009. أُعيد نشر هذه المادة هنا . مؤرشفة بتاريخ 14 نوفمبر 2019 على موقع Wayback Machine ، على مدونة شركة محركات بحث تجارية.
- سي، لو؛ شوكوهي، ميلاد (2011). "البحث الموحد". أسس واتجاهات استرجاع المعلومات . 5 : 1-102 . doi : 10.1561/1500000010 . S2CID 33433994 .
- مصطلحات الإنترنت
- خوارزميات البحث على الإنترنت
- تطبيقات الحوسبة الموزعة
