التصنيفات اللغوية

تشمل الفئات اللغوية

يُعدّ تعريف الفئات اللغوية من أهمّ اهتمامات النظرية اللغوية ، ولذا، يختلف تعريف الفئات وتسميتها باختلاف الأطر النظرية والتقاليد النحوية في اللغات المختلفة. ويتطلب تطبيق الفئات اللغوية في علم المعاجم ، واللغويات الحاسوبية ، ومعالجة اللغة الطبيعية ، وعلم لغويات المدونات ، وإدارة المصطلحات ، عادةً، تعريفاتٍ خاصة بالموارد أو المشكلات أو التطبيقات. وفي اللغويات المعرفية، يُجادل بأنّ للفئات اللغوية بنيةً نموذجيةً تُشبه بنية فئات الكلمات الشائعة في اللغة. [ 1 ]

قوائم الفئات اللغوية

لتيسير التوافق بين الموارد المعجمية والتعليقات اللغوية وأدوات التعليق، وللتعامل المنهجي مع الفئات اللغوية عبر مختلف الأطر النظرية، تم تطوير عدد من قوائم الفئات اللغوية، ويجري استخدامها، مع أمثلة موضحة أدناه. يتمثل الهدف العملي لهذه القوائم في إجراء تقييم كمي (للقوائم الخاصة بكل لغة)، أو تدريب أدوات معالجة اللغة الطبيعية، أو تسهيل التقييم والاستعلام والتعليق على البيانات اللغوية عبر اللغات. على المستوى النظري، تم افتراض وجود فئات عالمية في اللغة البشرية، كما في القواعد النحوية العالمية ، ولكنها تعرضت لانتقادات شديدة .

مجموعات علامات أجزاء الكلام

تُدرَّس عادةً في المدارس أن اللغة الإنجليزية تتكون من تسعة أقسام للكلام : الاسم ، والفعل ، وأداة التعريف ، والصفة ، وحرف الجر ، والضمير ، والظرف ، وحرف العطف ، وأداة التعجب . مع ذلك، من الواضح أن هناك العديد من الفئات والفئات الفرعية الأخرى. بالنسبة للأسماء، يمكن التمييز بين صيغ الجمع، والملكية، والمفرد. في العديد من اللغات، تُصنَّف الكلمات أيضًا حسب حالتها الإعرابية (دورها كفاعل، أو مفعول به، إلخ)، وجنسها النحوي ، وما إلى ذلك؛ بينما تُصنَّف الأفعال حسب زمنها ، وجانبها ، وأمور أخرى. في بعض أنظمة التصنيف، تحصل التصريفات المختلفة للكلمة الجذرية نفسها على أقسام كلام مختلفة، مما ينتج عنه عدد كبير من التصنيفات. على سبيل المثال، NN للأسماء العامة المفردة، وNNS للأسماء العامة الجمع، وNP للأسماء العلم المفردة (انظر تصنيفات أقسام الكلام المستخدمة في مدونة براون). تستخدم أنظمة تصنيف أخرى عددًا أقل من التصنيفات وتتجاهل الفروق الدقيقة أو تُنمذجها كخصائص مستقلة إلى حد ما عن قسم الكلام. [ 2 ]

في عملية تحديد أجزاء الكلام باستخدام الحاسوب، من المعتاد التمييز بين 50 إلى 150 جزءًا مختلفًا من الكلام في اللغة الإنجليزية. وقد أُجريت دراسات لتحديد أجزاء الكلام في لغاتٍ عديدة، وتختلف مجموعة علامات أجزاء الكلام المستخدمة اختلافًا كبيرًا باختلاف اللغة. عادةً ما تُصمَّم العلامات لتشمل فروقًا صرفية واضحة، على الرغم من أن هذا يؤدي إلى تناقضات، مثل استخدام علامات الحالة للضمائر دون الأسماء في اللغة الإنجليزية، واختلافات أكبر بكثير بين اللغات. قد تكون مجموعات العلامات للغات ذات التصريفات الكثيرة، مثل اليونانية واللاتينية ، كبيرة جدًا؛ وقد يكون تحديد الكلمات في اللغات اللاصقة، مثل لغات الإنويت، شبه مستحيل. استخدمت دراسةٌ حول الطرق الاحتمالية لتحديد أجزاء الكلام في اللغة اليونانية العامية (ديروز، 1990) أكثر من 1000 جزء من الكلام، ووجدت أن عدد الكلمات الغامضة في تلك اللغة يُقارب عددها في اللغة الإنجليزية. في حالة اللغات الغنية صرفيًا، يتم التعبير عن الواصف الصرفي النحوي عادةً باستخدام رموز مختصرة جدًا، مثل ncmsan للدلالة على الفئة  = اسم، والنوع  = شائع، والجنس  = مذكر، والعدد  = مفرد، والحالة  = منصوب، والعاقل  = لا .

ربما تكون مجموعة علامات Penn هي الأكثر شيوعًا لوضع علامات POS للغة الإنجليزية الأمريكية، والتي تم تطويرها في مشروع Penn Treebank.

مخططات الشرح متعددة اللغات

بالنسبة للغات أوروبا الغربية، طُوِّرت أنظمة ترميز قابلة للتطبيق عبر اللغات لأجزاء الكلام، والصرف، والنحو، وذلك باستخدام إرشادات EAGLES . وكانت "مجموعة الخبراء الاستشارية لمعايير هندسة اللغة" (EAGLES) مبادرةً من المفوضية الأوروبية ، نُفِّذت ضمن برنامج المديرية العامة الثالثة عشرة للبحوث والهندسة اللغوية من عام ١٩٩٤ إلى عام ١٩٩٨، بتنسيق من اتحاد بيزا للأبحاث، بيزا، إيطاليا. وتُقدِّم إرشادات EAGLES توجيهاتٍ للترميز الذي يُستخدم مع مجموعات النصوص ، ولا سيما لتحديد السمات ذات الصلة في اللغويات الحاسوبية وعلم المعاجم . وقد تعاونت العديد من الشركات ومراكز الأبحاث والجامعات والهيئات المهنية في جميع أنحاء الاتحاد الأوروبي لإصدار إرشادات EAGLES، التي تُحدِّد توصياتٍ للمعايير الفعلية وقواعد أفضل الممارسات في: [ ٣ ]

  • موارد لغوية واسعة النطاق (مثل مجموعات النصوص، والمعاجم الحاسوبية، ومجموعات الكلام
  • وسائل معالجة هذه المعرفة، عبر الأشكال اللغوية الحاسوبية ، ولغات الترميز، وأدوات البرمجيات المختلفة؛
  • وسائل تقييم الموارد والأدوات والمنتجات.

وقد ألهمت إرشادات فريق إيجلز أعمالاً لاحقة في مناطق أخرى أيضاً، مثل أوروبا الشرقية. [ 4 ]

بعد جيل، بدأ مجتمع البحث جهدًا مماثلًا تحت مظلة التبعيات العالمية . اقترح بيتروف وآخرون [ 5 ] [ 6 ] مجموعة علامات "عالمية"، ولكنها اختزالية للغاية، مع 12 فئة (على سبيل المثال، لا توجد أنواع فرعية للأسماء أو الأفعال أو علامات الترقيم، وما إلى ذلك؛ ولا يوجد تمييز بين "to" كعلامة مصدر مقابل حرف جر (وهو ليس من قبيل الصدفة "العالمية")، وما إلى ذلك). لاحقًا، استُكمل ذلك بمواصفات متعددة اللغات لبنية التبعية (تبعيات ستانفورد) [ 7 ] ، والبنية الصرفية (إنترست إنترلينغوا [ 8 ] ، استنادًا جزئيًا إلى تقليد مولتكست-إيست/إيغلز) في سياق التبعيات العالمية (UD)، وهو مشروع تعاوني دولي لإنشاء قواعد بيانات شجرية للغات العالم مع شروح قابلة للتطبيق عبر اللغات ("عالمية") لأجزاء الكلام، وبنية التبعية، والخصائص الصرفية (اختياريًا). تتمثل التطبيقات الأساسية في معالجة النصوص الآلية في مجال معالجة اللغة الطبيعية (NLP) والبحث في بناء الجملة وقواعد اللغة الطبيعية، لا سيما في التصنيف اللغوي . يستند نظام الشروح إلى ثلاثة مشاريع ذات صلة: يستخدم نظام شروح التبعية العالمية تمثيلًا على شكل أشجار تبعية بدلًا من أشجار بنية العبارة . اعتبارًا من فبراير 2019، يتوفر في قاعدة بيانات UD ما يزيد قليلًا عن 100 قاعدة بيانات شجرية لأكثر من 70 لغة. [ 9 ] يهدف المشروع بشكل أساسي إلى تحقيق اتساق في عملية التوصيف بين اللغات. ومع ذلك، يُسمح بإضافة امتدادات خاصة بكل لغة للخصائص الصرفية (يمكن للغات أو الموارد الفردية إضافة خصائص إضافية). وبشكل أكثر تقييدًا، يمكن توسيع علاقات التبعية بإضافة تسمية ثانوية تُصاحب تسمية UD، على سبيل المثال، aux:pass للفعل المساعد (UD aux ) المستخدم للدلالة على صيغة المبني للمجهول. [ 10 ]

ألهمت التبعيات العالمية جهودًا مماثلة في مجالات الصرف الاشتقاقي، [ 11 ] ودلالات الإطار، [ 12 ] والإحالة المرجعية . [ 13 ] أما بالنسبة لبنية الجملة ، فلا يبدو أن هناك جهدًا مماثلًا، ولكن تم تطبيق مواصفات بنك شجرة بن (Penn Treebank) على (وتوسيعها لتشمل) مجموعة واسعة من اللغات، [ 14 ] على سبيل المثال، الأيسلندية، [ 15 ] والإنجليزية القديمة، [ 16 ] والإنجليزية الوسطى، [ 17 ] والألمانية السفلى الوسطى، [ 18 ] والألمانية العليا الحديثة المبكرة، [ 19 ] واليديشية، [ 20 ] والبرتغالية، [ 21 ] واليابانية، [ 22 ] والعربية ، [ 23 ] والصينية. [ 24 ]

قواعد كتابة الشروح بين السطور

في علم اللغة ، يُعرف الشرح بين السطور بأنه شرح (سلسلة من التفسيرات الموجزة، مثل التعريفات أو النطق) يُوضع بين السطور ( بين + خطي )، كما هو الحال بين سطر من النص الأصلي وترجمته إلى لغة أخرى . عند إضافة الشرح، يكتسب كل سطر من النص الأصلي سطرًا أو أكثر من الترجمة النصية، تُعرف بالنص بين السطور أو النص المشرح بين السطور ( IGT ) - اختصارًا "بين السطور" . تُساعد هذه الشروح القارئ على تتبع العلاقة بين النص الأصلي وترجمته، وبنية اللغة الأصلية. لا يوجد قائمة موحدة للشروح، ولكن تُجمع التسميات الشائعة في قواعد لايبزيغ للشروح. [ 25 ] كما تُقدم ويكيبيديا قائمة باختصارات الشروح تستند إلى هذه القواعد ومصادر أخرى.

علم الوجود العام للوصف اللغوي (GOLD)

GOLD (الأنطولوجيا العامة للوصف اللغوي) هي أنطولوجيا خاصة باللغويات الوصفية . تقدم هذه الأنطولوجيا وصفًا رسميًا لأبسط الفئات والعلاقات المستخدمة في الوصف العلمي للغة البشرية، على سبيل المثال، كتوصيف رسمي للتفسيرات بين السطور. طُرحت GOLD لأول مرة من قِبل فارار ولانغيندوين (2003). [ 26 ] في الأصل، صُممت GOLD كحل لمشكلة توحيد أنظمة الترميز المختلفة للبيانات اللغوية، ولا سيما بيانات اللغات المهددة بالانقراض . مع ذلك، تُعد GOLD أكثر عمومية ويمكن تطبيقها على جميع اللغات. في هذا السياق، تتداخل GOLD مع سجل فئات البيانات ISO 12620 (ISOcat)، إلا أنها أكثر صرامة في بنيتها.

تولت قائمة اللغويين (LINGUIST List) وجهات أخرى صيانة قاعدة بيانات GOLD من عام 2007 إلى عام 2010. [ 27 ] أنشأ مشروع RELISH نسخة طبق الأصل من إصدار 2010 من GOLD كفئة بيانات مختارة ضمن ISOcat. وحتى عام 2018، لا تزال بيانات GOLD مركزًا مهمًا للمصطلحات في سياق سحابة البيانات اللغوية المفتوحة المرتبطة ، ولكن نظرًا لتوقف صيانتها بشكل فعال، يتم استبدال وظيفتها تدريجيًا بـ OLiA (للشرح اللغوي، بالاعتماد على GOLD وISOcat) و lexinfo.net (لبيانات تعريف القاموس، بالاعتماد على ISOcat).

ISO 12620 (ISO TC37 Data Category Registry, ISOcat)

المعيار ISO 12620 هو معيار صادر عن اللجنة الفنية 37 التابعة للمنظمة الدولية للمقاييس (ISO/TC 37) ، ويُعرّف سجل فئات البيانات ، وهو سجل لتسجيل المصطلحات اللغوية المستخدمة في مختلف مجالات الترجمة ، واللغويات الحاسوبية ، ومعالجة اللغة الطبيعية ، كما يُعرّف عمليات الربط بين المصطلحات المختلفة وبين الأنظمة المختلفة التي تُستخدم فيها المصطلحات نفسها. [ 28 ] [ 29 ] [ 30 ]

يُوفّر تطبيقٌ سابقٌ لهذا المعيار، وهو ISOcat، مُعرّفاتٍ ثابتةً ورموزَ URI للفئات اللغوية، بما في ذلك قائمةُ أنطولوجيا GOLD (انظر أدناه). يهدف السجلّ إلى تمكين الأنظمة الجديدة من إعادة استخدام المصطلحات الموجودة، أو على الأقل ربطها بسهولةٍ بالمصطلحات الموجودة، لتعزيز قابلية التشغيل البيني . [ 31 ] يُستخدم هذا المعيار في معايير أخرى مثل إطار عمل الترميز المعجمي (ISO 24613:2008)، وقد أُضيف عددٌ من المصطلحات إلى السجلّ، بما في ذلك إرشادات Eagles، والمدونة الوطنية للغة البولندية ، وتنسيق TermBase eXchange من جمعية معايير صناعة التوطين .

مع ذلك، فإن إصدار عام 2019، ISO 12620:2019، [ 32 ] لم يعد يوفر سجلاً للمصطلحات الخاصة بتقنية اللغة، واقتصر الآن على موارد المصطلحات، ومن هنا جاء العنوان المعدل "إدارة موارد المصطلحات - مواصفات فئات البيانات". وبناءً على ذلك، توقف تطوير ISOcat بشكل فعال. [ 33 ] اعتبارًا من مايو 2020، كانت أنظمة الخلفاء CLARIN Concept Registry [ 34 ] و DatCatInfo [ 35 ] في طور الظهور.

بالنسبة للفئات اللغوية ذات الصلة بالموارد المعجمية ، يُمثل معجم lexinfo معيارًا مجتمعيًا راسخًا، [ 36 ] لا سيما فيما يتعلق بمعجم OntoLex والقواميس المقروءة آليًا في سياق تقنيات البيانات اللغوية المفتوحة المرتبطة . وكما يعتمد معجم OntoLex على إطار عمل الترميز المعجمي (LMF)، يعتمد lexinfo على (قسم LMF من) ISOcat. [ 37 ] ولكن على عكس ISOcat، يتم صيانة lexinfo بشكل فعال، ويجري حاليًا (مايو 2020) توسيعه بجهود مجتمعية. [ 38 ]

أنطولوجيات الشرح اللغوي (OLiA)

على غرار مشروع GOLD، توفر أنطولوجيات الشرح اللغوي (OLiA) قائمة مرجعية للفئات اللغوية للظواهر النحوية والصرفية والدلالية ذات الصلة بالشرح اللغوي والمجموعات اللغوية ، وذلك في شكل أنطولوجيا . إضافةً إلى ذلك، توفر هذه الأنطولوجيات مخططات شرح قابلة للقراءة آليًا لأكثر من 100 لغة، مرتبطة بنموذج OLiA المرجعي. [ 39 ] تمثل أنطولوجيات OLiA مركزًا رئيسيًا لمصطلحات الشرح في سحابة البيانات المفتوحة المرتبطة (اللغوية) ، مع تطبيقات للبحث والاسترجاع والتعلم الآلي على موارد لغوية مشروحة بشكل غير متجانس. [ 37 ]

بالإضافة إلى أنظمة الشرح، يرتبط نموذج OLiA المرجعي أيضًا بإرشادات Eagles، [ 40 ] وGOLD، [ 40 ] وISOcat، [ 41 ] وسجل مفاهيم CLARIN، [ 42 ] والتبعيات العالمية، [ 43 ] وlexinfo، [ 43 ] وغيرها، مما يُمكّن من التوافق بين هذه المصطلحات. ويجري تطوير OLiA كمشروع مجتمعي على GitHub [ 44 ].

مراجع

  1. جون ر. تايلور (1995) التصنيف اللغوي: النماذج الأولية في النظرية اللغوية ، الطبعة الثانية، الفصل 2، ص 21
  2. بطاقات نقاط البيع العالمية
  3. أساسيات فرقة إيجلز
  4. ديميتروفا، ل.، إيدي، ن.، بيتكيفيتش، ف.، إيرجافيتش، ت.، كاليب، هـ. ج.، وتوفيس، د. (أغسطس 1998). Multitext-east: مجموعات لغوية ومعاجم متوازية وقابلة للمقارنة لست لغات من وسط وشرق أوروبا . في وقائع المؤتمر الدولي السابع عشر للغويات الحاسوبية - المجلد 1 (ص 315-319). رابطة اللغويات الحاسوبية.
  5. ^ بيتروف، سلاف. داس، ديبانجان؛ ماكدونالد ، ريان (11 أبريل 2011). “مجموعة علامات عالمية لجزء من الكلام”. أرخايف : 1104.2086 [ cs.CL ].
  6. بيتروف، سلاف (11 أبريل 2011). "مجموعة علامات أجزاء الكلام العالمية". arXiv : 1104.2086 [ cs.CL ].
  7. "التبعيات في ستانفورد" . nlp.stanford.edu . مجموعة ستانفورد لمعالجة اللغات الطبيعية . تم الاطلاع عليه بتاريخ 8 مايو 2020 .
  8. "Interset" . cuni.cz. معهد اللغويات الرسمية والتطبيقية (جمهورية التشيك) . تم الاطلاع عليه بتاريخ 8 مايو 2020 .
  9. "التبعيات العالمية" . universaldependencies.org . تم الاطلاع عليه بتاريخ 14-05-2020 .
  10. "aux:pass" . universaldependencies.org . تم الاطلاع عليه بتاريخ 14-05-2020 .
  11. UniMorph. "UniMorph: Universal Morphological Annotation" . UniMorph . تم الاسترجاع في 14 مايو 2020 .
  12. System-T/UniversalPropositions ، System-T، 14-05-2020 ، تم الاطلاع عليه في 14-05-2020
  13. برانج، ج.، شنايدر، ن.، وأبيند، أ. (أغسطس 2019). التعليق متعدد الطبقات المقيد دلاليًا: حالة الإحالة المشتركة . في وقائع ورشة العمل الدولية الأولى حول تصميم تمثيلات المعنى (ص 164-176).
  14. "مجموعة نصوص بن المُحللة للغة الإنجليزية التاريخية: مجموعات نصوص أخرى" . www.ling.upenn.edu . تاريخ الاسترجاع: 14 مايو 2020 .
  15. "مجموعة النصوص التاريخية المُحللة للغة الأيسلندية (IcePaHC)" . www.linguist.is . مؤرشف من الأصل بتاريخ 2022-06-06 . تم الاطلاع عليه بتاريخ 2020-05-14 .
  16. وارنر، أنتوني، قسم اللغة والعلوم اللغوية، جامعة يورك، يورك؛ تايلور، آن؛ وارنر، أنتوني؛ بينتزوك، سوزان؛ بيثس، فرانك (سبتمبر 2003). "مجموعة يورك-تورنتو-هلسنكي المُحللة للنثر الإنجليزي القديم (YCOE)" .{{cite journal}}يتطلب الاستشهاد بالمجلة ( مساعدة )|journal=
  17. "مجموعة بن-هلسنكي المُحللة للغة الإنجليزية الوسطى 2" . www.ling.upenn.edu . تاريخ الاسترجاع: 14-05-2020 .
  18. "مجموعة نصوص اللغة الألمانية الدنيا التاريخية" . www.chlg.ac.uk. تاريخ الاسترجاع: 14 مايو 2020 .
  19. لايت، سي.، ووالنبرغ، ج. (2011). حول استخدام المبني للمجهول في اللغات الجرمانية. عُرض في الاجتماع الثالث عشر لمؤتمر بناء الجملة التوليدي التاريخي (DIGS)، جامعة بنسلفانيا، 5 يونيو 2011.
  20. بياتريس سانتوريني (1993) [./ Ftp://babel.ling.upenn.edu/papers/faculty/beatrice%20santorini/santorini-1993.pdf معدل تغير بنية العبارة في تاريخ اللغة اليديشية]. تنوع اللغة وتغيرها 5، 257-283.
  21. "مشروع تيكو براهي" . www.tycho.iel.unicamp.br . تم الاطلاع عليه بتاريخ 14-05-2020 .
  22. "NPCMJ – مجموعة نصوص نينجال المحللة للغة اليابانية الحديثة" . تم الاطلاع عليه بتاريخ 14-05-2020 .
  23. "مجموعة بيانات اللغة العربية الشجرية: الجزء 3 (المجموعة الكاملة) الإصدار 2.0 (MPG + التحليل النحوي) - اتحاد البيانات اللغوية" . catalog.ldc.upenn.edu . تاريخ الاسترجاع: 14 مايو 2020 .
  24. "مشروع بنك الأشجار الصيني في جامعة بنسلفانيا" . verbs.colorado.edu . تم الاطلاع عليه بتاريخ 14 مايو 2020 .
  25. كومري، ب.، هاسبيلماث، م.، وبيكل، ب. (2008). قواعد لايبزيغ للتفسير: اصطلاحات للتفسيرات بين السطور، مورفيمًا بمورفيم . قسم اللغويات في معهد ماكس بلانك للأنثروبولوجيا التطورية وقسم اللغويات في جامعة لايبزيغ. تم الاطلاع عليه بتاريخ 28 يناير2010.
  26. سكوت فارار ودي. تيرينس لانغندوين (2003) "أنطولوجيا لغوية للويب الدلالي". GLOT International. 7 (3)، ص 97-100،.
  27. الإصدارات الذهبية
  28. "ISO 12620:1999 – تطبيقات الحاسوب في المصطلحات – فئات البيانات" . iso.org . 2011. تم الاطلاع عليه بتاريخ 9 نوفمبر 2011 .
  29. "ISO 12620:2009 – المصطلحات وموارد اللغة والمحتوى الأخرى – تحديد فئات البيانات وإدارة سجل فئات البيانات لموارد اللغة" . iso.org . 2011. تم الاطلاع عليه بتاريخ 9 نوفمبر 2011 .
  30. "ISO 12620:2019 إدارة موارد المصطلحات - مواصفات فئات البيانات" . المنظمة الدولية للمقاييس . تم الاطلاع عليه بتاريخ 20 يناير 2020 .
  31. بونونو، روبرت (2011). "مصطلحات للمترجمين - تطبيق لمعيار ISO 12620". ميتا . 45 (4): 646-669 . CiteSeerX 10.1.1.136.4771 . doi : 10.7202/002101ar . 
  32. "ISO 12620:2019 إدارة موارد المصطلحات - مواصفات فئات البيانات" . المنظمة الدولية للمقاييس . تم الاطلاع عليه بتاريخ 20 يناير 2020 .
  33. "تم تغيير عنوان مستودع فئات البيانات (DCR)" . www.iso.org . تاريخ الاسترجاع: 8 مايو 2020 .
  34. "سجل مفاهيم كلارين | كلارين إريك" . www.clarin.eu . تم الاطلاع عليه بتاريخ 8 مايو 2020 .
  35. "DatCatInfo" . www.datcatinfo.net . تم الاطلاع عليه بتاريخ 2020-05-08 .
  36. "LexInfo" . www.lexinfo.net . تم الاطلاع عليه بتاريخ 14-05-2020 .
  37. 1 2 سيميانو، ب.، تشياركوس، س.، مكراي، ج.ب.، وغراسيا، ج. (2020). البيانات اللغوية المرتبطة (ص 137-160). سبرينغر، تشام.
  38. ontolex/lexinfo ، مجموعة مجتمع OntoLex، 7 مارس 2020 ، تاريخ الاسترجاع 14 مايو 2020
  39. "OLiA ontologies" . purl.org/olia . تم الاطلاع عليه بتاريخ 14-05-2020 .
  40. 1 2 Chiarcos, C. (2008). An antonology of linguistic annotations . In LDV Forum (Vol. 23, No. 1, pp. 1-16).
  41. تشياركوس، سي. (مايو 2010). تأسيس أنطولوجيا للتعليقات اللغوية في سجل فئات البيانات . في ورشة عمل LREC 2010 حول معايير موارد اللغة وتكنولوجيا اللغة (LT<S)، فاليتا، مالطا (ص 37-40).
  42. ريم، جي.، غالانِس، دي.، لابروبولو، بي.، بايبيريديس، إس.، ويلس، إم.، أوسبيك، آر.، وآخرون (2020). نحو نظام بيئي قابل للتشغيل البيني لمنصات الذكاء الاصطناعي والتعلم الآلي: خارطة طريق لتنفيذ مستويات مختلفة من قابلية التشغيل البيني. نسخة أولية منشورة على arXiv : 2004.08355 .
  43. 1 2 كريستيان شياركوس، ماكسيم إيونوف وكريستيان فاث (2020)، قابلية التشغيل البيني للتعليقات التوضيحية في عصر ما بعد ISOcat، LREC 2020
  44. أكولي-ريبو/أوليا ، ACoLi، 10-03-2020 ، استرجاعها 14-05-2020