ISO 639
المعيار ISO 639 هو معيار صادر عن المنظمة الدولية للتوحيد القياسي (ISO) يُعنى بتمثيل اللغات ومجموعات اللغات . يتألف حاليًا من أربع مجموعات (1-3، 5) من الرموز، سُميت كل منها نسبةً إلى الجزء الذي كان يصف المجموعة المعنية (كان الجزء 4 عبارة عن إرشادات بدون نظام ترميز خاص به)؛ وقد نُشر جزء سادس ثم سُحب. تمت الموافقة عليه لأول مرة عام 1967 كتوصية ISO من جزء واحد ، ISO/R 639 ، [ 1 ] ثم استُبدل عام 2002 بالجزء 1 من السلسلة الجديدة، ISO 639-1 ، [ 2 ] وتلاه أجزاء إضافية. دُمجت جميع أجزاء السلسلة في معيار واحد عام 2023، [ 3 ] استنادًا إلى حد كبير إلى نص ISO 639-4.
استخدام رموز ISO 639
تُستخدم رموز اللغات المحددة في أقسام معيار ISO 639 لأغراض ببليوغرافية، وفي بيئات الحوسبة والإنترنت، كعنصر أساسي في بيانات اللغة . كما تُستخدم هذه الرموز في تطبيقات متنوعة، مثل روابط ويكيبيديا لإصداراتها اللغوية المختلفة.
تاريخ
تجلّت الصيغة المبكرة لنظام ترميز اللغات التابع للمنظمة الدولية للتوحيد القياسي (ISO) في المواصفة ISO/R 639:1967 بعنوان " رموز اللغات والبلدان والسلطات "، والتي هدفت أساسًا إلى تنظيم المصطلحات الدالة على اللغات والبلدان وهيئات التقييس التابعة للهيئات الأعضاء في المنظمة. وتألفت "رموز اللغات" من مُعرّفات متغيرة الطول، تتكون من حرف أو حرفين، مكتوبة بأحرف لاتينية كبيرة، مثل 1 أو 2 Eللغة Enالإنجليزية؛ Sو 3 أو Sp4 أو Es5 للغة الإسبانية؛ و 6 أو In7 للغة الإندونيسية. كما سُمح باستخدام (النسخة السابقة لعام 1993 من) رموز UDC المساعدة للدلالة على اللغات.
| الاسم (باللغة الإنجليزية) | حرف واحد | حرفان | مقاطعة كولومبيا | (1988) | (المجموعة الحالية 1) |
|---|---|---|---|---|---|
| الأفريكانية | — | Af | =393.6 | af | af |
| عربي | — | Ar | =927 | ar | ar |
| البلغارية | — | Bg | =867 | bg | bg |
| الصينية | C | Ch | =951 | zh | zh |
| التشيك | — | Cs | =850 | cs | cs |
| الألمانية | D | De | =30 | de | de |
| دانماركي | — | Da | =398 | da | da |
| إنجليزي | E | En | =20 | en | en |
| الإسبرانتو | — | Eo | =089.2 | eo | eo |
| الأسبانية | S | EsSp | =60 | es | es |
| فرنسي | F | Fr | =40 | fr | fr |
| الفنلندية | — | Fi | =945.41 | fi | fi |
| اليونانية | G | Gr | =75 | el | el |
| العبرية | — | He | =924 | iw | he |
| الهندية | — | Hi | =914.3 | hi | hi |
| المجرية | — | Hu | =945.11 | hu | hu |
| إيطالي | I | It | =50 | it | it |
| لغة إنترلينغوا | — | Ia | =089.7 | ia | ia |
| مترجم لغوي | — | Ie | =089.6 | ie | ie |
| إندونيسيا | — | In | =992.21 | in | id |
| اليابانية | J | Ja | =956 | ja | ja |
| كوري | — | Ko | =957 | ko | ko |
| اللاتينية | L | La | =71 | la | la |
| هولندي | — | Nl | =393.1 | nl | nl |
| النرويجية | — | No | =396 | no | no |
| بولندي | — | Pl | =84 | pl | pl |
| البرتغالية | — | Pt | =690 | pt | pt |
| الروسية | R | Ru | =82 | ru | ru |
| روماني | — | Ro | =590 | ro | ro |
| السنسكريتية | — | Sa | =912.3 | sa | sa |
| الصربي الكرواتي | — | Sh | =861/862 | sh | — |
| سلوفاكيا | — | Sk | =854 | sk | sk |
| السلوفيني | — | Sn | =863 | sl | sl |
| السويدية | — | Sv | =397 | sv | sv |
| تركي | — | Tr | =943.5 | tr | tr |
| الأوكرانية | — | Uk | =83 | uk | uk |
| الأردية | — | Ur | =914.31 | ur | ur |
بعد فصل رمز البلد إلى ISO 3166 في عام 1974، تم نشر الإصدار الأول من معيار ISO 639:1988 رمز تمثيل أسماء اللغات بإطار من المعرفات المكونة من حرفين بشكل موحد بأحرف لاتينية صغيرة، وهي متطابقة في الغالب من حيث الشكل والمفردات مع مجموعة ISO 639 الحالية 1.
منذ ذلك الحين، اعتُمد هذا المعيار كتقنية أساسية في صناعة الحوسبة سريعة النمو ( RFC 1766 )، مما أدى إلى تطوير إطار عمل أكثر تعبيرًا مكونًا من ثلاثة أحرف، نُشر تحت مسمى ISO 639-2:1998، ويعتمد بشكل كبير على رموز MARC للغات. أُعيد تعريف النظام الأصلي المكون من حرفين تحت مسمى ISO 639-1 في عام 2001.
سعياً لتوفير دعم أوسع للغات بهدف توسيع نطاق التطبيقات، تم إنشاء مجموعتين فرعيتين منفصلتين من نطاق أسماء ISO 639-2، تغطيان لغات فردية ومجموعات لغوية، وهما ISO 639-3 وISO 639-5 على التوالي. كما جرت محاولة لترميز متغيرات لغوية أكثر دقة باستخدام معرّفات من أربعة أحرف تحت مسمى ISO 639-6، والذي تم سحبه لاحقاً وإعادة تنظيمه ضمن إطار عمل آخر، هو ISO 21636 .
كانت التحديثات المستمرة نسبيًا في أجزاء من معيار ISO 639 تُدار من قِبل كل جهة مسؤولة على حدة حتى صدور معيار ISO 639:2023، الذي وحّد نصوص المعايير السابقة وأحدث تغييرًا تنظيميًا بإنشاء وكالة صيانة مشتركة تشرف على جميع المجموعات وتصدر النشرات الإخبارية. يقع مقر وكالة الصيانة في النرويج. [ 4 ]
المجموعات الحالية والأجزاء التاريخية من المعيار
| مجموعة (الجزء الماضي) | الاسم السابق ( رموز تمثيل أسماء اللغات - ... ) | وكالة ترميز اللغات (سلطة التسجيل سابقاً) | الطبعة الأولى | حاضِر | رقم في القائمة ( اعتبارًا من 12 يوليو 2023) ) |
|---|---|---|---|---|---|
| المجموعة 1 | الجزء الأول: رمز ألفا-2 | مصطلح المعلومات | 1967 (الأصل ISO/R 639) | 2023 | 183 |
| المجموعة الثانية | الجزء الثاني: رمز ألفا-3 | مكتبة الكونغرس | 1998 | 2023 | 482 + 20 B-only + 4 خاص + 520 للاستخدام المحلي [ 5 ] [ 6 ] |
| المجموعة 3 | الجزء 3: رمز ألفا-3 لتغطية شاملة للغات | منظمة SIL الدولية | 2007 | 2023 | 7916 + 4 خاصة + 520 للاستخدام المحلي [ 7 ] |
| (ISO 639-4) | الجزء الرابع: إرشادات التنفيذ والمبادئ العامة لترميز اللغة | ISO/TC 37 / SC 2 | 2010-07-16 | 2023 | (ليست قائمة) |
| المجموعة 5 | الجزء 5: رمز ألفا-3 لعائلات ومجموعات اللغات | مكتبة الكونغرس | 15-05-2008 | 2023 | 115 (بما في ذلك 36 مجموعة متبقية + 29 مجموعة عادية من ISO 639-2) [ 8 ] |
| ( ISO 639-6 ) | الجزء 6: تمثيل ألفا-4 لتغطية شاملة لمتغيرات اللغة (تم سحبه) | لغة جيولانغ | 2009-11-17 | تم سحبها | أكثر من 21000 |
تتولى وكالة ترميز لغوي صيانة كل مجموعة من المعايير، حيث تضيف رموزًا وتُعدّل حالة الرموز عند الحاجة. وقد تم سحب معيار ISO 639-6 في عام 2014، [ 9 ] ولم يُدرج في معيار ISO 639:2023.
خصائص الرموز الفردية
النطاقات:
- اللغات الفردية
- اللغات الكلية (المجموعة 3)
- مجموعات اللغات (المجموعتان 2 و5). بعض المجموعات كانت موجودة بالفعل في المجموعة 2، والبعض الآخر تمت إضافته فقط في المجموعة 5:
- مجموعات الباقي: 36 مجموعة في كل من المجموعة 2 و 5 هي من هذا النوع - من أجل التوافق مع المجموعة 2 عندما لم يتم نشر المجموعة 5 بعد، لا تحتوي مجموعات الباقي على أي لغة ومجموعة تم ترميزها بالفعل في المجموعة 2 (ومع ذلك، يمكن للتطبيقات الجديدة المتوافقة مع المجموعة 5 التعامل مع هذه المجموعات بشكل شامل، طالما أنها تحترم التسلسل الهرمي للاحتواء المنشور في المجموعة 5 وتستخدم المجموعة الأكثر تحديدًا عند تجميع اللغات)؛
- المجموعة الوحيدة التي تم تخصيص رمز مكون من حرفين أبجديين لها سابقًا هي البيهاري (bh) خلال حقبة الجزء 1، والتي تم إيقافها في يونيو 2021. [ 10 ]
- المجموعات العادية: 29 مجموعة في كل من المجموعتين 2 و 5 هي من هذا النوع - من أجل التوافق مع المجموعة 2، لا يمكن أن تحتوي على مجموعات أخرى؛
- العائلات: 50 مجموعة جديدة تم ترميزها فقط في المجموعة 5 (بما في ذلك مجموعة تحتوي على مجموعة عادية تم ترميزها بالفعل في المجموعة 2) - من أجل التوافق مع المجموعة 2، قد تحتوي على مجموعات أخرى باستثناء مجموعات الباقي.
- مجموعات الباقي: 36 مجموعة في كل من المجموعة 2 و 5 هي من هذا النوع - من أجل التوافق مع المجموعة 2 عندما لم يتم نشر المجموعة 5 بعد، لا تحتوي مجموعات الباقي على أي لغة ومجموعة تم ترميزها بالفعل في المجموعة 2 (ومع ذلك، يمكن للتطبيقات الجديدة المتوافقة مع المجموعة 5 التعامل مع هذه المجموعات بشكل شامل، طالما أنها تحترم التسلسل الهرمي للاحتواء المنشور في المجموعة 5 وتستخدم المجموعة الأكثر تحديدًا عند تجميع اللغات)؛
- اللهجات : كان من المفترض أن يتم تغطيتها بموجب معيار ISO 639-6 السابق (المقترح ولكن تم سحبه الآن).
- حالات خاصة (المجموعتان 2 و3).
- مخصص للاستخدام المحلي (المجموعتان 2 و3). ويستخدم أحيانًا في التطبيقات التي تتطلب رمزًا مكونًا من حرفين مثل الرموز القياسية في المجموعتين 1 و2 (حيث
misلا يكون الرمز الخاص مناسبًا)، أو رمزًا مكونًا من ثلاثة أحرف للمجموعات مثل الرموز القياسية في المجموعة 5.
الأنواع (لللغات الفردية):
- اللغات الحية (المجموعتان 2 و3) (باستثناء السنسكريتية، جميع اللغات الكبرى الأخرى هي لغات حية) [ 11 ]
- اللغات المنقرضة (المجموعتان 2 و3) (599، [ 12 ] 5 منها في المجموعة 2:
chb،chg،cop،lui،sam؛ لا توجد أي لغة في المجموعة 1) - اللغات التاريخية (المجموعات 1، 2، 3) (213، [ 13 ] 35 منها في المجموعة 2؛ و5 منها، وهي
ave،chu، ،latوpli،sanلها رمز في المجموعة 1 أيضًا:ae،cu،la،pi،sa)- صُنّف 124 منها كلغات قديمة ، [ 14 ] وقد اندمج هذا النوع في اللغات التاريخية منذ حوالي عام 2024.
- اللغات المصطنعة (المجموعات 1، 2، 3) (23، [ 15 ] 9 منها في المجموعة 2:
afh،epo،ido،ile،ina،jbo،tlh،vol،zbl؛ 5 منها في المجموعة 1:eo،ia،ie،io،vo)
اللغات الفردية واللغات الكلية ذات الرمزين المميزين المكونين من ثلاثة أحرف في المجموعة 2:
- المراجع الببليوغرافية (بعضها تم إهماله، ولم يتم تعريف أي منها في المجموعة 3): هذه رموز قديمة (تستند إلى أسماء اللغات باللغة الإنجليزية).
- المصطلحات (المحددة أيضًا في المجموعة 3): هذه هي الرموز المفضلة (استنادًا إلى أسماء اللغات الأصلية، مع كتابة الأحرف اللاتينية إذا لزم الأمر).
- أما البقية (بما في ذلك مجموعات اللغات والرموز الخاصة/المحجوزة) فلها رمز واحد مكون من ثلاثة أحرف فقط لكلا الاستخدامين.
العلاقات بين المجموعات
صُممت مجموعات معيار ISO 639 المختلفة لتتكامل معًا، بحيث لا يحمل أي رمز معنىً مختلفًا في مجموعة عن معناه في مجموعة أخرى. مع ذلك، لا تندرج جميع اللغات ضمن جميع المجموعات، وتختلف طرق معالجة اللغات والعناصر الأخرى في المجموعات المختلفة. يعتمد هذا، على سبيل المثال، على ما إذا كانت اللغة مُدرجة في المجموعة 1 أو 2، أو ما إذا كانت لها رموز B/T منفصلة في المجموعة 2، أو ما إذا كانت مُصنفة كلغة كلية في المجموعة 3، وهكذا.
تُفصّل هذه المعالجات المختلفة في الجدول التالي. في كل مجموعة من الصفوف (صف لكل نطاق من المجموعة 3)، تحتوي الأعمدة الأربعة الأخيرة على رموز للغة نموذجية تُجسّد نوعًا محددًا من العلاقات بين مجموعات معيار ISO 639، ويُقدّم العمود الثاني شرحًا لهذه العلاقة، بينما يُشير العمود الأول إلى عدد العناصر التي تربطها هذه العلاقة. على سبيل المثال، هناك أربعة عناصر لها رمز في المجموعة 1، ورمز B/T، وتُصنّف كلغات كلية في المجموعة 3. ومن بين هذه العناصر الأربعة، اللغة faالفارسية . perfas
| نِطَاق | عدد الحالات | وصف | مثال على مطابقة الرموز | |||
|---|---|---|---|---|---|---|
ISO 639 المجموعة 1 | ISO 639 المجموعة 2 | ISO 639 المجموعة 3 | ISO 639 المجموعة 5 | |||
| اللغات الفردية (أنا) | 128 | اللغات الفردية غير المنتمية إلى لغة كلية، ولكل منها رمز في المجموعات 1 و2 و3 (رمز واحد فقط في المجموعة 2). يوجد 184 رمزًا مُخصصًا في المجموعة 1 للغات الفردية أو اللغات الكلية أو المجموعات؛ بطرح الرموز المحسوبة في الصفوف أدناه، يتبقى: 184 - (2 I من B/T سابقًا ) - (3+11 I ) - (3+2 I من B/T ) - (28+4+1+1 M ) - (1 C ) = 128 رمزًا. | en | eng | — | |
| 2 | اللغات الفردية، التي لها رمز في كل من المجموعات 1 و2 و3، والتي كانت لها رموز B/T منفصلة في المجموعة 2، ولكن تم سحب رموز B الخاصة بها (منذ 28-06-2008) مع الاحتفاظ برموز T الخاصة بها لجميع الاستخدامات. هذه اللغات هي: hr/( scr)/ hrvو sr/( scc)/ srp. كلاهما جزء من نفس اللغة الكلية hbsالمضافة في المجموعة 3 لتشمل أيضًا لغات فردية أخرى مشفرة حديثًا، ولكن تم سحب رمزها shفي المجموعة 1 أيضًا ولم يكن لها رمز محدد في المجموعة 2. | hr | ( scr)/ hrv(B/T) | hrv | ||
| 3 | اللغات الفردية التي تنتمي إلى لغة رئيسية في المجموعة 3، مع رمز واحد في المجموعة 2 وأيضًا رمز في المجموعة 1. هذه هي: bs/ bos(جزء من اللغة الرئيسية hbs)، nb/ nobو nn/ nno(كلاهما جزء من اللغة الرئيسية no/ nor). | nb | nob | |||
| 11 | اللغات الفردية ذات رموز B/T منفصلة في المجموعة 2، ولكن ليس في أي من الحالات الخاصة في الأسطر اللاحقة. يوجد 20 زوجًا من رموز B/T المنفصلة المخصصة في المجموعة 2 للغات الفردية أو اللغات الكلية؛ بطرح الحالات الخاصة أدناه، يتبقى: 20 ‒ (3+2 M ) ‒ (4 C ) = 11 زوجًا من الرموز. | de | ger/ deu(B/T) | deu | ||
| 3 | اللغات الفردية ذات رموز B/T منفصلة في المجموعة 2، لكن الأحرف من رمز المجموعة 1 ليست أول حرفين من رمز المجموعة 2T. وهما: cs/ cze/ ces، mi/ mao/ mri، و sk/ slo/ slk. | cs | cze/ ces(B/T) | ces | ||
| 3 | اللغات الفردية في المجموعتين 2 و3 (لا تنتمي إلى لغة كلية)، ولكنها كانت مغطاة في المجموعة 1 برمز مكافئ له في المجموعة 2 هو رمز جماعي. وهذه هي: bho، mai، و mag. | ( bh) | bho | |||
| عدد قليل | أي لغة فردية أخرى في المجموعتين 2 و3، بدون رمز في المجموعة 1. | — | ast | |||
| 1 | اللغات الفردية المضافة في المجموعة 3 بدون رموز في المجموعتين 1 و 2، ولكن تم تغطيتها بواسطة لغة كلية في المجموعتين 2 و 3 مشفرة أيضًا في المجموعة 1. | ( ar) | ( ara) | arb | ||
| 1 | لغة فردية في المجموعة 3، بدون رمز في المجموعة 2، ولكن تم تغطيتها في المجموعة 1 بواسطة رمز مكافئ له في المجموعة 2 هو مجموعة جماعية (انظر المدخل أدناه لهذه المجموعة). | ( bh) | ( bih) | sck | ||
| > 7000 | أي لغة فردية أخرى في المجموعة 3 بدون أي رمز في المجموعتين 1 و 2 (ربما يتم تغطيتها في المجموعة 2 بواسطة رمز جماعي، مثل nic"النيجر-كودوفانية (أخرى)" وهي مجموعة متبقية). | — | ( nic) | aaa | ||
| اللغات الكلية ("M") | 28 | اللغات الكبيرة في المجموعة 3 التي لها أيضًا رموز في المجموعتين 1 و2. هناك 62 رمزًا مخصصًا في المجموعة 3 للغات الكبيرة؛ اطرح تلك التي لها حالات خاصة أدناه، وهذا يتبقى: 62 ‒ (4 "B/T") ‒ 1 ‒ (25+1+3 "ليس في المجموعة 1") = 28 رمزًا. | ar | ara | ||
| 4 | اللغات الكلية في المجموعة 3 مع رموز B/T منفصلة في المجموعة 2. وهذه هي: fa/ per/ fas، ms/ may/ msa، sq/ alb/ sqi، و zh/ chi/ zho. | fa | per/ fas(B/T) | fas | ||
| 1 | اللغة الكلية في المجموعة 3 التي تحتوي على لغات لها رموز في المجموعة 1. فقط: no/ nor(تحتوي على: nb/ nobو nn/ nno). | no | nor | |||
| 25 | اللغات الكلية في المجموعتين 2 و 3، ولكن بدون كود في المجموعة 1. | — | bal | |||
| 1 | لغة الماكرو في المجموعة 3، بدون كود في المجموعة 2، والتي تم إيقاف استخدامها في المجموعة 1. | ( sh) | — | hbs | ||
| 3 | اللغات الكلية في المجموعة 3، بدون رموز في المجموعة 1 أو 2. وهذه هي: bnc، kln، و luy. | — | — | bnc | ||
| العائلات والجماعات (جماعية) ("ج") | 1 | تم تصنيف اللغة البيهاري كلغة جماعية ولها رمز المجموعة 2. كانت تحمل رمز المجموعة 1 ولكن تم إيقاف استخدامه في عام 2021. [ 10 ] والسبب هو أن ثلاث لغات بيهاري فردية (مختلفة بما يكفي بحيث لا يمكنها تشكيل نفس اللغة الكلية للمجموعة 3) حصلت على رموز مميزة للمجموعة 2 ( bho،، mai) mag، مما جعل اللغة البيهاري مجموعة متبقية لأغراض المجموعة 2 (تحتوي على لغات المجموعة باستثناء هذه اللغات الثلاث). | ( bh) | bih | — | bih |
| 35 | المجموعات المتبقية في المجموعة الثانية، أي نفس الرمز ولكن بلغات مختلفة. في المجموعة الثانية، afaتشير إلى لغة أفروآسيوية ليس لها مُعرِّف لغة فردي في المجموعة الثانية، ولا تندرج ضمن المجموعات الثلاث المتبقية: ber"البربرية (أخرى)"، أو cus"الكوشية (أخرى)"، أو sem"السامية (أخرى)"، وكلها مجموعات لغوية أفروآسيوية. | — | afa | afa | ||
| 29 | المجموعة المنتظمة في المجموعة 2، هي نفسها عائلة اللغة في المجموعة 5، ولا يوجد رمز في المجموعة 1. ومن بينها، ypkكانت المجموعة المنتظمة في المجموعة 2 هي الوحيدة التي تم ترميزها في المجموعة 5 كجزء من مجموعة منتظمة جديدة أخرى في المجموعة 5 لم يتم ترميزها في المجموعة 2 (انظر أدناه). | aus | aus | |||
| 50 | أُضيفت المجموعات المنتظمة في المجموعة 5 فقط، ولم تكن مُرمّزة سابقًا في المجموعات 1 و2 و3. معظم هذه المجموعات المنتظمة الجديدة ربما كانت ممثلة سابقًا برمز جماعي آخر في المجموعة 2 كجزء من مجموعة متبقية (على سبيل المثال، المجموعة المتبقية ineللمجموعة المنتظمة الجديدة sqj)، باستثناء 7 منها: aav، esx، euq، hmx، jpx، urj، بالإضافة إلى syd(جزء من المجموعة المنتظمة الجديدة urj). مع ذلك، كانت المجموعة المنتظمة ypk(جزء من المجموعة المنتظمة الجديدة esx) مُرمّزة بالفعل في المجموعة 2. انظر إلى تسلسل المجموعات اللغوية في قائمة رموز ISO 639 المجموعة 5 . | — | sqj | |||
| الرموز الخاصة (S) | 1 | يُمكن استخدام هذا الخيار في سياق أحادي اللغة حيث يلزم رمز لغة مُحدد، ولكن لا يوجد رمز قياسي لتلك اللغة. يُمكن أن يكون البديل الأكثر دقة استخدام مجموعة مُتبقية من المجموعة 2 أو رمز عائلة لغوية من المجموعة 5، إلا إذا كان لا بد من استبعاد لغات أخرى في تلك المجموعة (لأنها مُفصولة برمزها الخاص) أو لم يكن هناك رمز جماعي قياسي مُناسب. قد تُفضل بعض التطبيقات استخدام رمز أكثر تحديدًا ضمن الرموز المُخصصة للاستخدام المحلي. | — | mis | — | |
| 1 | محتوى متعدد اللغات (يشمل لغتين على الأقل في مجموعات منفصلة). يُستخدم هذا النوع عندما يُتوقع استخدام رمز لغة واحد للمحتوى بأكمله. قد تكون اللغات الفردية أو اللغات الكلية لكل جزء من المحتوى غير مُرمّزة بعد (ويمكن تمثيلها misبرمز جماعي أو برمز أكثر دقة). | mul | ||||
| 1 | غير محدد (يتضمن المحتوى صفرًا أو لغة واحدة أو لغات متعددة، في تركيبة عشوائية). | und | ||||
| 1 | لا توجد أي معلومات لغوية على الإطلاق (أضيفت في 11 يناير 2006). المحتوى (مثل الرسومات والصور والتسجيلات الصوتية/المرئية التي لا تتضمن نصًا بلغة بشرية، أو البيانات الوصفية التقنية ومعظم شفرة المصدر البرمجية) قابل للاستخدام كما هو بأي لغة، ولا ينبغي ترجمته (باستثناء وصفه الذي قد يكون مرتبطًا بمحتويات منفصلة، أو أجزاء غير أساسية من المحتوى). | zxx | ||||
| مخصص للاستخدام المحلي ("R") | 20 | الرموز المكونة من حرفين في المجموعة 1، ضمن النطاق qa... qtهذه الرموز غير موصى بها، ولكنها تُركت بدون تعيين في المجموعة 1. | qa | — | ||
| 520 | الرموز المكونة من ثلاثة أحرف في المجموعتين 2 و3، في النطاق qaa... qtz. يمكن استخدام هذه الرموز أيضًا للغات الجماعية (أو حالات خاصة أخرى)، ولكن لن يتم تخصيص أي عائلات أو مجموعات لغوية قياسية لها في المجموعة 5. | — | qaa | |||
وتعود هذه الاختلافات إلى العوامل التالية.
في المجموعة الثانية من معيار ISO 639 ، تم تخصيص رمزين مميزين لـ 22 لغة، وهما رمز ببليوغرافي ورمز مصطلحات (رموز B/T). [ 16 ] أُدرجت رموز B لأسباب تاريخية، إذ كانت أنظمة الببليوغرافيا السابقة واسعة الانتشار تستخدم رموزًا لغوية تستند إلى الاسم الإنجليزي للغة. في المقابل، استندت رموز المجموعة الأولى إلى الاسم الأصلي للغة، وكان هناك أيضًا رغبة قوية في وجود رموز للمجموعة الثانية (رموز T) لهذه اللغات، بحيث تكون مشابهة للرمز المقابل المكون من حرفين في المجموعة الأولى.
- على سبيل المثال، تحتوي اللغة الألمانية (المجموعة 1:
de) على رمزين في المجموعة 2:ger(رمز B) وdeu(رمز T)، بينما يوجد رمز واحد فقط في المجموعة 2،eng، للغة الإنجليزية . - تم سحب رمزين سابقين من فئة B، ولم يتبق اليوم سوى 20 زوجًا من رموز B/T.
تحتوي اللغات الفردية في المجموعة 2 دائمًا على رمز في المجموعة 3 (يتم إعادة استخدام رمز المصطلحات الخاص بالمجموعة 2 فقط هناك) ولكن قد يكون لها رمز في المجموعة 1 أو لا، كما هو موضح في الأمثلة التالية:
- المجموعة 3
engتتوافق مع المجموعتين 2engو 1en - المجموعة 3
astتتوافق مع المجموعة 2astولكنها تفتقر إلى رمز موجود في المجموعة 1.
بعض الرموز (62) في المجموعة 3 هي لغات كلية. وهي مجموعات تضم لغات فردية متعددة تربطها علاقة جيدة، وغالبًا ما يتم خلطها أو الالتباس بينها. وقد طورت بعض اللغات الكلية صيغة قياسية افتراضية لإحدى لغاتها الفردية (على سبيل المثال، تُعتبر لغة الماندرين افتراضيًا للغة الصينية الكلية، ويمكن تمييز اللغات الفردية الأخرى عند الحاجة، ولكن cmnنادرًا ما يُستخدم الرمز الخاص بلغة الماندرين).
- تحتوي لغة ماكرو واحدة على رمز من المجموعة 2 ورمز من المجموعة 1، بينما تحتوي لغاتها الفردية الأعضاء أيضًا على رموز في المجموعتين 1 و2:
nor/noيحتوي علىnno/nn،nob/nb؛ أو - تحتوي 4 لغات ماكرو على رمزين من المجموعة 2 (B/T) ورمز من المجموعة 1:
per/fas/fa،may/msa/ms،alb/sqi/sq، وchi/zho/zh؛ - 28 لغة برمجة رئيسية لها رمز المجموعة 2 ولكن ليس لها رمز المجموعة 1؛
- 29 لغة برمجة رئيسية أخرى تحتوي فقط على رموز في المجموعة 3.
تحتوي الرموز الجماعية في المجموعة 2 على رمز في المجموعة 5: على سبيل المثال ausفي المجموعتين 2 و 5، والتي ترمز إلى اللغات الأسترالية .
- أُضيفت بعض الرموز في المجموعة 5، ولكن لم يكن لها أي رمز في المجموعة 2: على سبيل المثال
sqj
تحتوي المجموعتان 2 و3 أيضًا على نطاق محجوز وأربعة رموز خاصة:
- الرموز
qaaمن خلالqtzمحجوزة للاستخدام المحلي. - هناك أربعة رموز خاصة:
misللغات التي لم يتم تعيين رمز لها بعد،mulو"لغات متعددة"،undو"غير محدد"، وzxx"لا يوجد محتوى لغوي، غير قابل للتطبيق".
مساحة الكود
مساحة رمز مكونة من حرفين
تُستخدم في المجموعة الأولى مُعرّفات ثنائية الأحرف (كانت تُعرف سابقًا باسم "ألفا-2") (للرموز المُكوّنة من حرفين من الأبجدية اللاتينية الأساسية ISO ) . وعندما رُغِبَ في استخدام رموز لنطاق أوسع من اللغات، حيث كان بالإمكان تغطية أكثر من تركيبتين حرفيتين (بحد أقصى 26 × 2 = 676)، طُوِّرت المجموعة الثانية باستخدام رموز ثلاثية الأحرف. (مع ذلك، نُشرت المجموعة الثانية رسميًا أولًا. [ 17 ] [ 18 ] )
مساحة رمز مكونة من ثلاثة أحرف
تُستخدم مُعرّفات ثلاثية الأحرف (المعروفة سابقًا باسم "ألفا-3") (للرموز المُكوّنة من 3 أحرف من الأبجدية اللاتينية الأساسية ISO ) في المجموعة 2 والمجموعة 3 والمجموعة 5. ويبلغ عدد اللغات ومجموعات اللغات التي يُمكن تمثيلها بهذه الطريقة 26 ÷ 3 = 17576.
يتطلب الاستخدام المشترك للرموز المكونة من ثلاثة أحرف من قبل ثلاث مجموعات من معيار ISO 639 بعض التنسيق داخل نظام أكبر.
تُعرّف المجموعة الثانية أربعة رموز خاصة mis، mulو، undو، zxxو، ونطاقًا محجوزًا qaa-qtz(20 × 26 = 520 رمزًا)، وتحتوي على 20 مدخلًا مزدوجًا (رموز B/T)، بالإضافة إلى مدخلين برموز B مهملة. وبذلك، يصل مجموع الرموز إلى 520 + 22 + 4 = 546 رمزًا لا يمكن استخدامها في المجموعة الثالثة لتمثيل اللغات، أو في المجموعة الخامسة لتمثيل عائلات أو مجموعات لغوية. والباقي هو 17576 - 546 = 17030.
يوجد اليوم ما يقارب ستة إلى سبعة آلاف لغة على وجه الأرض. [ 19 ] لذا فإن هذه الرموز البالغ عددها 17030 رمزًا كافية لتخصيص رمز فريد لكل لغة، على الرغم من أن بعض اللغات قد ينتهي بها المطاف برموز عشوائية لا تشبه إطلاقًا الاسم (الأسماء) التقليدي لتلك اللغة.
مساحة رمز ألفا-4 (تم سحبها)
تم اقتراح استخدام رموز "ألفا-4" (الرموز المكونة من 4 أحرف من الأبجدية اللاتينية الأساسية ISO ) في معيار ISO 639-6 ، والذي تم سحبه. الحد الأقصى لعدد اللغات واللهجات التي يمكن تمثيلها هو 26 × 4 = 456,976.
انظر أيضاً
- علامات لغة IETF (استنادًا إلى ISO 639)
- ISO 3166 (رموز الدول)
- ISO 15924 (رموز أنظمة الكتابة )
- رموز اللغات المصطنعة
- رمز اللغة
- عائلات اللغات واللغات
- قائمة اللغات
- قائمة اللغات الرسمية
- قوائم رموز ISO 639
ملاحظات ومراجع
- ↑ "ISO/R 639:1967" . المنظمة الدولية للتوحيد القياسي. 1988-03-01 . تم الاطلاع عليه بتاريخ 2012-08-05 .
- ↑ "ISO 639:1988" . المنظمة الدولية للتوحيد القياسي . تم الاطلاع عليه بتاريخ 2012-08-05 .
- ↑ "ISO 639:2023" . المنظمة الدولية للتوحيد القياسي . تم الاطلاع عليه بتاريخ 15-11-2023 .
- ↑ "وكالات الصيانة وهيئات التسجيل" . ISO.org . تم الاطلاع عليه بتاريخ 15 يناير 2025 .
- ↑ "الرموز مرتبة أبجديًا حسب رمز ألفا-3/ISO 639-2" . مكتبة الكونغرس. 25 يوليو 2013. تاريخ الاسترجاع: 10 يناير 2019 .
- ↑ "رموز ISO-639-2" . مكتبة الكونغرس . تم الاطلاع عليه بتاريخ 10 يناير 2019 .
- ↑ "مجموعة رموز ISO 639-3 (UTF-8)" . منظمة SIL الدولية . تم الاطلاع عليه بتاريخ 12 يوليو 2023 .
- ↑ "رموز ISO 639-5 مرتبة حسب المعرّف" . مكتب تطوير الشبكات ومعايير MARC . مكتبة الكونغرس . تم الاطلاع عليه بتاريخ 12 ديسمبر 2018 .
- ↑ ISO 639-6:2009 ، ISO .
- 1 2 منظمة SIL الدولية (2021-06-14). "تغيير رمز اللغة للجزء 1" . ISO 639-3 .
- ↑ "جداول رموز ISO 639: لغات الماكرو" . Sil.org . تم الاطلاع عليه بتاريخ 2012-08-05 .
- ↑ "جداول رموز ISO 639: منقرضة" . Sil.org . تم الاطلاع عليه بتاريخ 2012-08-05 .
- ↑ "جداول رموز ISO 639: تاريخية" . Sil.org . تم الاطلاع عليه بتاريخ 2012-08-05 .
- ↑ "جداول رموز ISO 639: قديمة" . Sil.org . تم الاطلاع عليه بتاريخ 10 يناير 2019 .
- ↑ "جداول رموز ISO 639: تم إنشاؤها" . Sil.org . تم الاسترجاع في 2022-02-07 .
- ↑ "ISO 639-2 – الأسئلة الشائعة" . مكتبة الكونغرس. 2014-05-05 . تاريخ الاسترجاع: 2014-12-12 .
- ↑ "رموز تمثيل أسماء اللغات - الجزء 2: رمز ألفا-3" . المنظمة الدولية للمعايير . ISO . تاريخ الاسترجاع: 10 يناير 2019.
تاريخ النشر
: 1998-10
- ↑ "رموز تمثيل أسماء اللغات - الجزء 1: رمز ألفا-2" . المنظمة الدولية للمعايير . ISO . تاريخ الاطلاع: 15 فبراير 2018.
تاريخ النشر
: 2002-07
- ↑ "ملخصات إحصائية" . إثنولوج . تم الاسترجاع في 2012-08-05 .
روابط خارجية
- معيار ISO 639 على الموقع الرسمي لمنظمة ISO
- مواقع وكالة ترميز اللغات:
- رمز اللغة ISO 639 في Infoterm، LCA للمجموعة 1 (قائمة الرموز مقدمة من المجموعة 2 LCA أدناه)
- ISO 639-2 في مكتبة الكونغرس، LCA للمجموعة 2
- ISO 639-3 في SIL International، تقييم دورة الحياة للمجموعة 3
- ISO 693-5 في مكتبة الكونغرس، LCA للمجموعة 5
- تقارير وكالة الصيانة ISO 639
- مستودع بيانات اللغة المشتركة الذي يحتوي على ترجمات لرموز ISO 639 بلغات أخرى بصيغة XML. كما تحتوي أداة مسح CLDR على تنسيق بيانات أكثر سهولة في القراءة.
- ISO 639
- معايير ISO
- معرّفات اللغة
- التدويل والتوطين
- مقدمات عام 1967
