مناطق الاستخدام الخاص

في يونيكود ، تُعرف مناطق الاستخدام الخاص ( PUA ) بثلاث مجموعات غير مُخصصة لها أحرف وفقًا للمعيار. [ 1 ] هذه المجموعات الثلاث هي: منطقة الاستخدام الخاص ، في المستوى الأساسي متعدد اللغات ( U+E000 U+F8FFومنطقة الاستخدام الخاص التكميلية-أ ، ومنطقة الاستخدام الخاص التكميلية-ب ، حيث تقع المجموعتان الأخيرتان في المستويين 15 و16 تقريبًا ( U+F0000 U+FFFFD ، U+100000 U+10FFFD ) على التوالي، وتغطيانهما بالكامل تقريبًا. وقد تُركت هذه المناطق غير مُحددة عمدًا لتمكين جهات خارجية من تخصيص أحرفها الخاصة دون تعارض مع تخصيصات معيار يونيكود. وبموجب سياسة استقرار يونيكود، ستظل مناطق الاستخدام الخاص مُخصصة لهذا الغرض في جميع إصدارات يونيكود المستقبلية. [ 2 ]

لا يشترط أن تكون تخصيصات رموز الاستخدام الخاص "خاصة" بالمعنى الداخلي البحت للمؤسسة؛ فقد نشرت عدة مؤسسات مخططات تخصيص عديدة. قد يتضمن هذا النشر خطًا يدعم التعريف (يعرض الرموز)، وبرامج تستخدم هذه الرموز (مثل رمز رسومي لوظيفة "طباعة المستند"). وبحسب التعريف، قد تُخصص جهات خاصة متعددة رموزًا مختلفة لنفس الرمز، ما قد يؤدي إلى رؤية المستخدم رمزًا خاصًا من خط مُثبّت بدلًا من رمز آخر.

تعريف

بحسب تعريف يونيكود، فإن رموز المناطق الخاصة ليست أحرفًا غير موجودة، ولا محجوزة، ولا غير مخصصة. فئتها هي " Other, private use (Co)"، ولم يتم تحديد أسماء للأحرف. لا توجد رموز تمثيلية، وتُترك دلالات الأحرف للاتفاق الخاص.

تُخصَّص رموز يونيكود للأحرف ذات الاستخدام الخاص، ولا يُحدَّد تفسيرها في هذا المعيار، ويُمكن تحديد استخدامها باتفاق خاص بين المستخدمين المتعاونين. هذه الأحرف مُخصَّصة للاستخدام الخاص، ولا تمتلك دلالات مُحدَّدة وقابلة للتفسير إلا باتفاق خاص. ... لا توجد جداول مُقدَّمة للأحرف ذات الاستخدام الخاص، لأن هذه الأحرف، بطبيعتها، مُعرَّفة فقط خارج سياق هذا المعيار. [ 3 ]

مكعبات

يوجد ثلاثة أقسام PUA في يونيكود. [ 3 ] [ 4 ] [ 5 ]

في المستوى الأساسي متعدد اللغات (المستوى 0)، تحتوي الكتلة المسماة منطقة الاستخدام الخاص (PUA) على 6400 نقطة رمزية.

تم تخصيص المستويين 15 و16 بالكامل تقريبًا [ ملاحظة 1 ] لمنطقتين إضافيتين للاستخدام الخاص: منطقة الاستخدام الخاص التكميلية-أ (SPUA-A) ومنطقة الاستخدام الخاص التكميلية-ب (SPUA-B). في ترميز UTF-16، تُستخدم مجموعة فرعية من البدائل العليا (U+DB80..U+DBFF) لهذين المستويين فقط، وتُسمى هذه البدائل بالبدائل العليا للاستخدام الخاص .

تاريخ

في يونيكود 1.0.0، امتدت منطقة الاستخدام الخاص من U+E800 إلى U+FDFF [ 6 ] (أي أنها لم تشمل U+E000..E7FF، ولكنها شملت أيضًا نطاق U+F900..FDFF الذي تشغله الآن رموز التوافق الصينية اليابانية واليابانية والكورية ، وأشكال العرض الأبجدية ، وأشكال العرض العربية-أ ). تم تغيير هذا النطاق إلى U+E000..F8FF في يونيكود 1.0.1 [ 7 ] ، وبقي كذلك في يونيكود 1.1 [ 8 ] . أما النطاق U+D800..DFFF، المستخدم لبدائل UTF-16 منذ يونيكود 2.0، فكان غير مخصص ولم يكن جزءًا من منطقة الاستخدام الخاص في أي إصدار من يونيكود 1.x.

تم تصنيف المستويات من E0 (224) إلى FF (255)، والمجموعات من 60 (96) إلى 7F (127) من مجموعة الأحرف المشفرة العالمية (أي من U+E00000 إلى U+FFFFFF ومن U+60000000 إلى U+7FFFFFFF) للاستخدام الخاص. وقد أُزيلت هذه النطاقات عندما اقتصرت مجموعة الأحرف المشفرة العالمية على المستويات السبعة عشر المتاحة في UTF-16. [ 9 ]

الاستخدام

تستخدم مبادرة التقييس

أنشأ العديد من الأفراد والمؤسسات مجموعات أحرف لاتفاقية الاستخدام الخاص (PUA). بعض هذه الاتفاقيات منشورة، ما يُمكّن مُنفذي PUA الآخرين من استهداف نقاط الترميز غير المستخدمة أو الأقل استخدامًا لتجنب التداخل. وقد تم ترميز العديد من الأحرف والنصوص التي كانت مُرمّزة سابقًا في اتفاقيات الاستخدام الخاص بالكامل في يونيكود، مما استلزم إنشاء روابط بين PUA ونقاط ترميز يونيكود الأخرى.

يُعد سجل يونيكود ConScript (CSUR) أحد أشهر اتفاقيات استخدام المحتوى غير المُصرَّح به (PUA) وأكثرها تطبيقًا. يوفر هذا السجل، غير المُعتمد رسميًا أو المرتبط باتحاد يونيكود، خريطةً للنصوص المُصنَّعة، مثل نص كلينغون pIqaD ونص فيرينجي (ستار تريك)، ونصوص تينغوار وسيرث (الكتابة اليدوية والرونية لجيه آر آر تولكين)، ونص ألكسندر ميلفيل بيل المرئي ، وأبجدية دكتور سوس من رواية " ما وراء الحمار الوحشي" . وقد سبق لـ CSUR أن قام بتشفير أحرف فايستوس غير المُفكَّكة ، بالإضافة إلى أبجديتي شافيان وديزيريت ، والتي تم قبولها جميعًا للتشفير الرسمي في يونيكود.

تُعدّ مبادرة خطوط يونيكود في العصور الوسطى (MUFI) اتفاقية شائعة أخرى ضمن اتفاقية استخدام الأحرف غير المصرح بها (PUA). يسعى هذا المشروع إلى دعم جميع الاختصارات والوصلات والأحرف المركبة مسبقًا والرموز وأشكال الأحرف البديلة الموجودة في نصوص العصور الوسطى المكتوبة بالأبجدية اللاتينية. والهدف الرئيسي لمبادرة MUFI هو تحديد الأحرف اللازمة لتمثيل هذه النصوص تجريبيًا، وترميز هذه الأحرف رسميًا في يونيكود. اعتبارًا من إصدار يونيكود 5.1، تم دمج 152 حرفًا من أحرف MUFI في ترميز يونيكود الرسمي.

توجد بعض مجموعات الأحرف المتفق عليها في إطار برنامج PUA جزئيًا أو كليًا لأن اتحاد يونيكود ليس في عجلة من أمره لترميزها. ومن المرجح أن يتم ترميز بعضها، مثل اللغات غير المُمثلة، في المستقبل. وتقع بعض الحالات غير المألوفة، مثل اللغات الخيالية، خارج النطاق المعتاد ليونيكود، ولكن مبادئ يونيكود لا تستبعدها صراحةً، وقد تظهر في نهاية المطاف (مثل أنظمة كتابة ستار تريك وتولكين). وفي حالات أخرى، ينتهك الترميز المقترح واحدًا أو أكثر من مبادئ يونيكود، وبالتالي من غير المرجح أن يعترف به يونيكود رسميًا - لا سيما عندما يرغب المستخدمون في ترميز الأشكال البديلة أو الوصلات أو تركيبات الحرف الأساسي مع علامات التشكيل مباشرةً (مثل نظام TUNE).

مؤسسة النشرعنوانمنطقة PUA المستخدمةنوع الخط
CSURبعض الكتابات الاصطناعية وبعض الكتابات القديمة/التي تعود للعصور الوسطىPUA (BMP) والطائرة 15كود 2000
موفيالنصوص القروسطيةPUA (BMP)عديد
سيلعلم الصوتيات واللغاتPUA (BMP)شاريس سيل
تيتوسالكتابات القديمة والوسيطةPUA (BMP)تيتوس سايبربيت بيسك
  • تم تعريف الرموز التعبيرية في الأصل في مساحات غير مستخدمة ضمن ترميزات Shift JIS للهواتف المحمولة، حيث تدعم شركات الاتصالات المختلفة رموزًا تعبيرية مختلفة. قبل إضافة الرموز التعبيرية إلى معيار يونيكود في الإصدار 6.0، حددت كل من جوجل وشركات الاتصالات اليابانية الرئيسية نطاقات استخدام خاصة بها للرموز التعبيرية. حددت شركات الاتصالات اليابانية أنظمة الترميز الخاصة بها في نطاق الاستخدام الخاص للمستوى متعدد اللغات الأساسي، بينما حددت جوجل نظامها في نطاق الاستخدام الخاص التكميلي-أ. [ 10 ]
  • GB/T 20542-2006 ("امتداد مجموعة الأحرف المشفرة التبتية A") و GB/T 22238-2008 ("امتداد مجموعة الأحرف المشفرة التبتية B") هما معياران وطنيان صينيان يستخدمان PUA لترميز الوصلات التبتية المركبة مسبقًا .
  • استخدمت GBK والإصدارات السابقة من GB 18030 رمز PUA لترميز الأحرف غير الموجودة في معايير Unicode وقت النشر بشكل مؤقت. في إصدار 2022 من المعيار (GB 18030-2022)، يتم ربط الأحرف برموز Unicode القياسية الخاصة بها. [ 11 ]
  • يستخدم معهد اللغة الإستونية PUA لترميز الأحرف اللاتينية والسيريلية المركبة مسبقًا [ 12 ] التي ليس لها ترميز Unicode.
  • يستخدم مشروع خط تينغوار المجاني خريطة مختلفة من سجل يونيكود ConScript والتي تتبع إلى حد كبير ورقة مناقشة تينغوار لمايكل إيفرسون بتاريخ 2001-03-07، ولكنها تختلف في بعض التفاصيل.
  • يستخدم معيار MARC 21 PUA لترميز الأحرف الآسيوية الشرقية الموجودة في MARC-8 [ 13 ] والتي ليس لها ترميز Unicode.
  • تستخدم SIL Corporate PUA نظام PUA لترميز الأحرف المستخدمة في لغات الأقليات التي لم يتم قبولها بعد في Unicode .
  • يستخدم مشروع STIX Fonts برنامج PUA لتوفير مجموعة خطوط شاملة من الرموز والأبجديات الرياضية، والعديد منها متوفر أيضًا في SMP الآن، على سبيل المثال في كتلة الرموز الأبجدية الرقمية الرياضية .
  • تستخدم SMuFL PUA لترميز رموز التدوين الموسيقي الجديدة، مما يوسع كتلة رموز الموسيقى Unicode.
  • يُعد ترميز يونيكود الجديد للغة التاميلية (TUNE) [ 14 ] مخططًا مقترحًا لترميز اللغة التاميلية يتغلب على أوجه القصور المتصورة في ترميز يونيكود الحالي.

استخدام البائع

بشكل غير رسمي، يُعرف النطاق من U+F000 إلى U+F8FF بمنطقة الاستخدام المؤسسي. يعود أصل هذا المصطلح إلى الإصدارات الأولى من يونيكود، التي حددت "منطقة المستخدم النهائي" الممتدة من U+E000 صعودًا و"منطقة الاستخدام المؤسسي" الممتدة من U+F8FF نزولًا، مع ترك الحد الفاصل بينهما غير محدد. [ 8 ]

أحرف للاستخدام الخاص في مجموعات أحرف أخرى

يستند مفهوم حجز رموز محددة للاستخدام الخاص إلى استخدامات مماثلة سابقة في مجموعات أحرف أخرى. على وجه الخصوص، لا تزال العديد من الأحرف التي كانت تُعتبر قديمة في نصوص شرق آسيا تُستخدم في أسماء محددة أو في مواقف أخرى، ولذلك سمحت بعض مجموعات الأحرف لتلك النصوص باستخدام أحرف خاصة (مثل المستويات المُعرَّفة من قِبل المستخدم في CNS 11643 ، أو gaiji في بعض الترميزات اليابانية). يشير معيار يونيكود إلى هذه الاستخدامات تحت اسم "تعريف حرف المستخدم النهائي" (EUCD). [ 3 ]

بالإضافة إلى ذلك، تحتوي كتلة التحكم C1 على رمزين مخصصين للاستخدام الخاص "لوظائف التحكم" وفقًا لمعيار ECMA-48 : 0x91 للاستخدام الخاص الأول (PU1) و0x92 للاستخدام الخاص الثاني (PU2). [ 35 ] [ 36 ] يتضمن Unicode هذين الرمزين في U+0091 <control-0091>و U+0092 <control-0092>لكنها تُعرّفها على أنها أحرف تحكم (فئة Cc)، وليست أحرف استخدام خاص (فئة Co). [ 4 ] [ 37 ]

شهدت أنظمة الترميز التي لا تحتوي على مناطق استخدام خاصة، ولكنها تحتوي على مناطق غير مستخدمة إلى حد ما، مثل ISO/IEC 8859 و Shift JIS ، تطور نسخ غير خاضعة للرقابة من هذه الأنظمة. [ 38 ] بالنسبة إلى Unicode، يمكن لشركات البرمجيات استخدام مناطق الاستخدام الخاصة لإضافة الميزات التي ترغب بها.

ملحوظات

  1. يُعرَّف الحرفان الأخيران من كل مستوى على أنهما ليسا حرفين . أما الأحرف المتبقية البالغ عددها 65,534 حرفًا من كل مستوى من المستويين 15 و16، فتُخصَّص كأحرف للاستخدام الخاص.

مراجع

  1. "مسرد مصطلحات يونيكود: "منطقة الاستخدام الخاص (PUA)"" . اتحاد يونيكود .
  2. "سياسة استقرار ترميز الأحرف في يونيكود" . اتحاد يونيكود. 10 نوفمبر 2021. تم الاطلاع عليه بتاريخ 3 مارس 2022 .
  3. 1 2 3 "الفصل 23: المناطق الخاصة وأحرف التنسيق" (ملف PDF) . معيار يونيكود الإصدار 14.0 - المواصفات الأساسية . اتحاد يونيكود. سبتمبر 2021. أحرف للاستخدام الشخصي. ISBN 978-1-936213-29-0.
  4. 1 2 "قاعدة بيانات أحرف يونيكود" . معيار يونيكود . اتحاد يونيكود . تم الاسترجاع في 26 يوليو 2023 .
  5. "الإصدارات المرقمة من معيار يونيكود" . معيار يونيكود . تم الاطلاع عليه بتاريخ 26-07-2023 .
  6. "3.5: منطقة الاستخدام الخاص" (ملف PDF) . معيار يونيكود، الإصدار 1.0، المجلد 1. اتحاد يونيكود . 1991. الصفحات 118-119 . ISBN  0-201-56788-1تمت أرشفة الملف (PDF) من النسخة الأصلية بتاريخ 21 أكتوبر 2021. تم الاطلاع عليه بتاريخ 11 أكتوبر 2021 .
  7. يونيكود 1.0.1 (ملف PDF) . معيار يونيكود. اتحاد يونيكود. 3 نوفمبر 1992. مؤرشف (ملف PDF) من الأصل بتاريخ 2 يوليو 2016. تم الاطلاع عليه بتاريخ 9 يوليو 2016 .
  8. 1 2 "2.0: التغييرات في يونيكود 1.0" (ملف PDF) . معيار يونيكود، الإصدار 1.1 . اتحاد يونيكود . الصفحات 3-4 . UTR #4. مؤرشف (ملف PDF) من الأصل بتاريخ 20-11-2021 . تم الاطلاع عليه بتاريخ 11-10-2021 . 
  9. ويستلر، كين (2000). "التغييرات الضرورية لمعيار ISO/IEC 10646 فيما يتعلق بـ PUA" . يونيكود . UTC /00-015. مؤرشف من الأصل بتاريخ 23-06-2021 . تم الاطلاع عليه بتاريخ 30-01-2021 .
  10. شيرر، ماركوس؛ ديفيس، مارك؛ موموي، كات؛ تونغ، داريك؛ كيدا، ياسوو؛ إدبرغ، بيتر (27 أبريل 2010). "رموز الإيموجي: بيانات أساسية" (ملف PDF) . اتحاد يونيكود. L2/10-132 . تاريخ الاسترجاع: 24 أبريل 2025 .
  11. ^ لوند ، كين (4 أغسطس 2022). "معيار GB 18030-2022" . واسطة . تم الاسترجاع في 7 أغسطس 2022 .
  12. "قاعدة بيانات الرسائل" . Eki.ee. مؤرشفة من الأصل بتاريخ 21-05-2018 . تم الاطلاع عليها بتاريخ 11-04-2013 .
  13. "مجموعات الأحرف: أحرف شرق آسيا: خرائط يونيكود بديلة لأحرف MARC 21 المخصصة لمنطقة الاستخدام الخاص (PUA): مواصفات MARC 21 لبنية السجل، ومجموعات الأحرف، ووسائط التبادل" . مكتبة الكونغرس. 2004-09-02. مؤرشف من الأصل في 2013-08-19 . تم الاسترجاع في 2013-04-11 .
  14. "tunerfc.tn.nic.in" . تم أرشفة الموقع من المصدر الأصلي بتاريخ 29 يوليو 2010. تم الاطلاع عليه بتاريخ 11 أبريل 2013 .
  15. "القسم الفرعي للاستخدام المؤسسي لرموز يونيكود كما تستخدمه شركة أدوبي سيستمز" . 22 أكتوبر 1998. مؤرشف من الأصل في 9 أكتوبر 2002. تم الاطلاع عليه في 12 مايو 2021 .
  16. "NSOpenStepUnicodeReservedBase - وثائق مطوري Apple" . شركة Apple. مؤرشف من الأصل بتاريخ 2020-11-06 . تم الاطلاع عليه بتاريخ 2020-10-16 .
  17. شركة أبل للكمبيوتر (2005) [1994]. "CORPCHAR.TXT - سجل (نسخة خارجية) لاستخدام أبل لأحرف منطقة الشركة في يونيكود" . c03. اتحاد يونيكود . مؤرشف من الأصل بتاريخ 30-10-2020 . تم الاطلاع عليه بتاريخ 16-10-2020 .
  18. "نطاق يونيكود WGL4 من U+2013 إلى U+FB02" . مايكروسوفت . مؤرشف من الأصل بتاريخ 17-07-2014.
  19. "برنامج SFM يحوّل أسماء ملفات نظام الملفات HFS على نظام ماكنتوش إلى نظام الملفات NTFS Unicode" . دعم مايكروسوفت . 24 فبراير 2014. مؤرشف من الأصل في 27 مايو 2016.
  20. "ntfs.util.c" . GitHub . 2008. يتم ترميز أحرف أسماء ملفات NTFS غير الصالحة باستخدام أحرف Unicode الخاصة بـ SFM (خدمات ماكنتوش).
  21. «يتم ربط نطاق الأحرف بين U+F020 و U+F0FF في منطقة الاستخدام الخاص من يونيكود بخطوط الرموز في Richedit 4.1» . قاعدة معارف مايكروسوفت . مؤرشف من الأصل بتاريخ 22-10-2012.
  22. "معالجة شخصيات PUA في برامج مايكروسوفت" . SIL International . 25 أبريل 2003. مؤرشف من الأصل في 11 مايو 2015. تم الاطلاع عليه في 4 مارس 2014 .
  23. "التعليق رقم 8 : الخلل رقم 651606 (دائرة الأصدقاء) : الأخطاء : عائلة خط أوبونتو" . لانشباد . 5 أكتوبر 2010. مؤرشف من الأصل في 17 أكتوبر 2020. تم الاسترجاع في 17 أكتوبر 2020 .   
  24. "التعليق رقم ٢ : الخلل رقم ٨٥٣٨٥٥ : الأخطاء : عائلة خط أوبونتو" . لانشباد . ٢٦ سبتمبر ٢٠١١. مؤرشف من الأصل في ١٧ أكتوبر ٢٠٢٠. تم الاطلاع عليه في ١٧ أكتوبر ٢٠٢٠ .   
  25. لي، رينزي (23 أغسطس 2019). "اقتراح لإضافة أحرف إضافية إلى قسم الرسومات للحوسبة القديمة في نظام UCS" (ملف PDF) . يونيكود . تم الاطلاع عليه بتاريخ 31 يوليو 2023 .
  26. "التثبيت" . وثائق Powerline التجريبية . Powerline. تثبيت الخطوط . تم الاسترجاع في 21 أبريل 2025. يجب أيضًا تهيئة التطبيق المستخدم (مثل محاكي الطرفية) إما لاستخدام الخطوط المعدلة (في بعض الحالات يدعمها لأن الرموز المخصصة موجودة في منطقة استخدام خاصة تحتفظ بها بعض التطبيقات لنفسها) أو دعم fontconfig لكي يعمل Powerline بشكل صحيح مع الرموز الخاصة بـ Powerline.
  27. "lmb-excp.ucm" . GitHub . Unicode, Inc. 2000-02-10. مؤرشف من الأصل في 2022-01-25 . تم الاسترجاع في 2020-04-23 .
  28. "الملحق 2. مجموعة أحرف لوتس متعددة البايت (LMBCS)" [ الملحق 2. مجموعة أحرف لوتس متعددة البايت (LMBCS) ] ، دليل مرجعي لبرنامج لوتس 1-2-3 الإصدار 3.1 [ دليل مرجعي لبرنامج لوتس 1-2-3 الإصدار 3.1 ] (بالألمانية) ( الطبعة الأولى). كامبريدج، ماساتشوستس، الولايات المتحدة الأمريكية: شركة لوتس للتطوير . 1989. الصفحات من A2-1 إلى A2-13. 302168.  
  29. "CPGID 01445 (مخطط)" (ملف PDF) . السجل: مجموعات الأحرف الرسومية وصفحات الترميز . 2012 [2011]. الفصل 3-3220-050. تمثل المنطقة الموضحة في المخطط أعلاه 254 بايت فقط من الصف FF في المستوى 0F.
  30. "CPGID 01445: IBM AFP PUA رقم 1" . السجل: مجموعات الأحرف الرسومية وصفحات الترميز . 2012 [2011]. الفصل 3-3220-050. تمثل المنطقة الموضحة في الرسم البياني أعلاه 254 بايت فقط من الصف FF في المستوى 0F.
  31. "CPGID 01449: IBM default PUA" . عولمة IBM: معرّفات صفحات الترميز . IBM . مؤرشف من الأصل بتاريخ 16-09-2015. خصصت IBM 195 موضعًا من U+F83D إلى U+F8FF لاستخدامها كمنطقة IBM المؤسسية، وتعتزم استخدامها باستمرار داخل IBM كلما دعت الحاجة إلى الحفاظ على سلامة أحرف IBM ذهابًا وإيابًا.
  32. IBM (1997). unicode.nam: السماح بتحديد أحرف Unicode باستخدام أسماء IBM أو PostScript .(مضمنة مع أدوات عرض لوحة المفاتيح وصفحة الترميز لنظام التشغيل OS/2 من Borgendale وKen))
  33. "تكوين تعيين الأحرف لترجمة أسماء ملفات SMB على وحدات التخزين" . 9 ديسمبر 2021. تم الاطلاع عليه بتاريخ 14 أكتوبر 2022 .
  34. "خط تويتر تشيرب" . نسخ ولصق . تم الاسترجاع بتاريخ 2022-02-08 .
  35. "المعيار ECMA-48، الطبعة الخامسة - يونيو 1991" (ملف PDF) . §8.2.14 وظائف التحكم المتنوعة، §8.3.100، §8.3.101.
  36. ISO/TC97/SC2 (1983-10-01). C1 مجموعة أحرف التحكم في ISO 6429 (ملف PDF) . ITSCJ/ IPSJ . ISO-IR -77.
  37. "الفصل 4: خصائص الأحرف" (ملف PDF) . معيار يونيكود الإصدار 14.0 - المواصفات الأساسية . اتحاد يونيكود. سبتمبر 2021. الجدول 4-4. ISBN 978-1-936213-29-0.
  38. "خريطة (نسخة خارجية) من ترميز اللغة اليابانية لنظام التشغيل Mac OS إلى Unicode 2.1 والإصدارات الأحدث" . اتحاد Unicode. مؤرشف من الأصل بتاريخ 31 أغسطس 2021. تم الاطلاع عليه بتاريخ 8 أكتوبر 2021 .