الرموز الصينية واليابانية والكورية الموحدة

CJKV characterin traditional and simplemed Chinese, Korean, Vietnam and Japanese Forms

تشترك الكتابات الصينية واليابانية والكورية (المعروفة أيضًا باسم CJK ) في خلفية مشتركة، تُعرف مجتمعةً باسم أحرف CJK . خلال عملية توحيد الهان ، تم تحديد الأحرف المشتركة وتسميتها بالأحرف الصينية واليابانية والكورية الموحدة . اعتبارًا من يونيكود 17.0 ، يُعرّف يونيكود ما مجموعه 101,996 حرفًا. [ 1 ]

إن مصطلح "الرموز التصويرية" تسمية خاطئة، لأن الكتابة الصينية ليست تصويرية بل تصويرية ، ولكن تم اختيارها لكونها أكثر شيوعًا في اللغة الإنجليزية. [ 2 ]

وحتى أوائل القرن العشرين، كانت فيتنام تستخدم أيضًا الأحرف الصينية ( Chữ Nôm )، لذلك يتم استخدام الاختصار CJKV في بعض الأحيان.

مصادر

تتولى مجموعة أبحاث الرموز التصويرية (IRG) مسؤولية تطوير إضافات إلى مجموعات الرموز التصويرية الموحدة للغات الصينية واليابانية والكورية. تعالج المجموعة مقترحات الرموز التصويرية الموحدة الجديدة المقدمة من هيئاتها الأعضاء، وبعد خضوعها لعدة جولات من مراجعة الخبراء، تقدم المجموعة مجموعة موحدة من الرموز إلى الفريق العامل الثاني (WG2) التابع للجنة الفنية المشتركة 1 /اللجنة الفرعية 2 (JTC 1/SC 2) التابعة للمنظمة الدولية للمعايير/اللجنة الكهروتقنية الدولية (ISO/IEC ) واللجنة الفنية لليونيكود (UTC) للنظر في إدراجها في معيار ISO/IEC 10646 ومعيار اليونيكود . وقد شاركت الهيئات الأعضاء التالية في مجموعة أبحاث الرموز التصويرية في توحيد الرموز التصويرية الموحدة للغات الصينية واليابانية والكورية:

لا تقتصر الرموز التصويرية التي قدمتها كل من UTC والمملكة المتحدة على منطقة معينة، بل هي رموز اقترحها خبراء متخصصون لترميزها. أما الرموز التصويرية التي قدمتها SAT فهي مطلوبة لقاعدة بيانات نصوص SAT Daizōkyō .

يوضح الجدول أدناه عدد الأحرف الصينية واليابانية والكورية الموحدة المشفرة لكل مصدر من مصادر IRG لـ Unicode 17.0. [ 5 ] يتجاوز العدد الإجمالي للأحرف (267,742) بكثير عدد الأحرف الصينية واليابانية والكورية الموحدة المشفرة (101,996) حيث أن العديد من الأحرف لها أكثر من مصدر واحد.

توحيد الرموز الصينية واليابانية والكورية حسب المصدر
عضوعدد الأحرف
الصين69,724
هونغ كونغ17,654
اليابان52,560
كوريا الشمالية23975
كوريا الجنوبية21358
ماكاو344
تايوان59,570
المملكة المتحدة3409
فيتنام14276
قعد3715
التوقيت العالمي1157
المجموع267,742

مصادر التوقيت العالمي المنسق

أغلب الأحرف التي قدمتها لجنة يونيكود التقنية (UTC) إلى مجموعة أبحاث يونيكود الدولية (IRG) مستمدة من وثائق لجنة يونيكود التقنية (UTC). [ 6 ] وتشمل المصادر الأخرى ما يلي:

الطلب

تم تحديد ترتيب الأحرف الصينية واليابانية والكورية الموحدة ضمن مجموعات يونيكود (باستثناء الأحرف المضافة لاحقًا) مبدئيًا بالرجوع إلى القواميس الأربعة التالية. وقد رُتبت هذه الأحرف في الأساس وفقًا لترتيب قاموس كانغشي ، ثم رُوجعت القواميس الأخرى بالترتيب نفسه للأحرف غير الموجودة في قاموس كانغشي، وذلك لتحديد الحرف الذي يجب أن يتبعه في الترتيب. [ 7 ]

  1. قاموس كانغشي
  2. داي كان وا جيتن
  3. هانيو دا زيديان
  4. داي جاون

لا يُستخدم هذا النظام مع كتل يونيكود المُضافة حديثًا. لم يعد فريق البحث الإيديوغرافي يستخدم قاموس داي جاويون [ 8 ] ولا قاموس داي كان-وا جيتن [ 9 ] في أعماله. لا يزال قاموس كانغشي وهانيو دا زيديان يُستخدمان [ 8 ] في مراجع مصادر الأحرف الحالية [ 10 ] وكبدائل محتملة لمراجع المصادر الحالية التي تبيّن أنها خاطئة [ 11 ] . وبالمثل، على الرغم من أنه كان يتم توفير فهرس قاموس كانغشي (حقيقي أو افتراضي) سابقًا كجزء من بيانات التقديم لأحرف مصدر UTC، إلا أن هذا لم يعد هو الحال [ 12 ] . بدلًا من ذلك، يتم توفير نوع ضربة أول ضربة متبقية (أول ضربة لا تُشكّل جزءًا من الجذر ) مع جميع الأحرف المُقدّمة، ويُستخدم لترتيب الأحرف التي لها نفس الجذر وعدد الضربات داخل كتلة يونيكود الجديدة [ 13 ] .

مجموعات الرموز الصينية واليابانية والكورية الموحدة

الرموز الصينية واليابانية والكورية الموحدة

تحتوي المجموعة الأساسية المسماة "الأحرف الصينية الموحدة (4E00–9FFF)" على 20,992 حرفًا صينيًا أساسيًا ضمن النطاق من U+4E00 إلى U+9FFF. ولا تقتصر هذه المجموعة على الأحرف المستخدمة في نظام الكتابة الصيني فحسب ، بل تشمل أيضًا أحرف الكانجي المستخدمة في نظام الكتابة الياباني ، وأحرف الهانجا في كوريا ، وأحرف تشو نوم في اللغة الفيتنامية. وتُستخدم العديد من الأحرف في هذه المجموعة في أنظمة الكتابة الثلاثة جميعها ، بينما تُستخدم أحرف أخرى في نظام كتابة واحد أو اثنين فقط.

يُعرف هذا الجزء أيضًا باسم المجموعة الموحدة والترتيب ( URO )، خاصةً عندما يكون من الضروري تمييزه عن أجزاء الرموز الصينية واليابانية والكورية الموحدة الأخرى. [ 14 ]

تُرتّب الأحرف الـ 20902 الأولى في المجموعة وفقًا لترتيب الجذور في قاموس كانغشي . في هذا النظام، تُدرج الأحرف المكتوبة بأقل عدد من الضربات أولًا. أما الأحرف المتبقية فقد أُضيفت لاحقًا، ولذلك فهي ليست مرتبة حسب الجذور.

يُعدّ هذا التشكيل نتيجةً لتوحيد الهان ، [ 15 ] الذي أثار جدلاً إلى حدٍّ ما في شرق آسيا. [ 16 ] ولأنّ الأحرف المفردة المستخدمة في أكثر من لغة من اللغات الصينية واليابانية والكورية كانت تُرمّز في الموقع نفسه، ولأنّ الأعراف الطباعية الحديثة ومناهج الكتابة اليدوية تختلف اختلافًا طفيفًا بين المناطق (ليس بالضرورة على طول الحدود اللغوية - على سبيل المثال، هونغ كونغ وتايوان ، اللتان تستخدمان الصينية التقليدية ، لديهما أعراف محلية مختلفة قليلاً)، [ 17 ] فإنّ مظهر الحرف المُختار قد يعتمد على الخط المُستخدم. ومع ذلك، يطبّق نظام URO قاعدة فصل المصدر ، ما يعني أنّ أزواج الأحرف التي تُعامل على أنّها مُختلفة في مجموعة أحرف تُستخدم كمصدر لنظام URO (مثل JIS X 0208 كما هو مُستخدم في Shift JIS على سبيل المثال ) ستظلّ أزواجًا من الأحرف المنفصلة في ترميز Unicode الجديد. [ 18 ]

باستخدام مُحدِّدات التباين ، يُمكن تحديد بعض أشكال الأحرف الصينية واليابانية والكورية المُختلفة ضمن نظام يونيكود. [ 19 ] تُعدّ مجموعة أحرف Adobe-Japan1 ، التي تحتوي على 14684 تسلسلًا من أشكال الأحرف المُختلفة ، [ 20 ] مثالًا بارزًا على استخدام مُحدِّدات التباين. [ 21 ]

الرسوم البيانية

4E00–62FF ، 6300–77FF ، 7800–8CFF ، 8D00–9FFF .

مصادر

ملاحظة: تظهر معظم الأحرف في مصادر متعددة، لذا فإن مجموع عدد الأحرف الفردية (108,493) أكبر بكثير من عدد الأحرف المشفرة (20,992). [ 22 ]

في يونيكود 4.1، تم تخصيص 14 حرفًا من HKSCS-2004 و8 أحرف من GB 18030 للمناطق الواقعة بين نقطتي الترميز U+9FA6 وU+9FBB. ومنذ ذلك الحين، أُضيفت إضافات أخرى إلى هذه المنطقة لأسباب مختلفة، مُلخصة جميعها في قسم تاريخ الإصدارات أدناه.

امتداد الرموز الصينية واليابانية والكورية الموحدة (CJK) - أ

تحتوي الكتلة المسماة CJK Unified Ideographs Extension A (3400–4DBF) على 6592 حرفًا إضافيًا في النطاق U+3400 إلى U+4DBF.

الرسوم البيانية

3400–4DBF .

مصادر

ملاحظة: تظهر معظم الأحرف في أكثر من مصدر واحد، لذا فإن مجموع عدد الأحرف الفردية (23997) أكبر بكثير من عدد الأحرف المشفرة (6592). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة (ب)

تحتوي المجموعة المسماة " امتداد الأحرف الصينية واليابانية والكورية الموحدة B (20000–2A6DF)" على 42720 حرفًا ضمن النطاق U+20000 إلى U+2A6DF. وتشمل هذه الأحرف معظم الأحرف المستخدمة في قاموس كانغشي غير الموجودة في مجموعة الأحرف الصينية واليابانية والكورية الموحدة الأساسية، بالإضافة إلى العديد من أحرف هان-نوم التي كانت تُستخدم سابقًا لكتابة اللغة الفيتنامية.

الرسوم البيانية

20000–215FF ، 21600–230FF ، 23100–245FF ، 24600–260FF ، 26100–275FF ، 27600–290FF ، 29100–2A6DF .

مصادر

ملاحظة: تظهر العديد من الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (100887) أكبر بكثير من عدد الأحرف المشفرة (42720). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة C

تحتوي الكتلة المسماة CJK Unified Ideographs Extension C (2A700–2B73F) على 4160 حرفًا في النطاق من U+2A700 إلى U+2B73F. وقد أضيفت في البداية في Unicode 5.2 (2009).

الرسوم البيانية

2A700–2B73F .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (4967) أكبر من عدد الأحرف المشفرة (4160). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة D

تحتوي الكتلة المسماة CJK Unified Ideographs Extension D (2B740–2B81F) على 222 حرفًا في النطاق U+2B740 إلى U+2B81D والتي تمت إضافتها في Unicode 6.0 (2010).

الرسوم البيانية

2B740–2B81F .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (260) أكبر من عدد الأحرف المشفرة (222). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة E

تحتوي الكتلة المسماة CJK Unified Ideographs Extension E (2B820–2CEAF) على 5774 حرفًا في النطاق من U+2B820 إلى U+2CEAD. وقد أُضيفت في الأصل في يونيكود 8.0 (2015).

الرسوم البيانية

2B820–2CEAF .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (6272) أكبر من عدد الأحرف المشفرة (5774). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة F

تحتوي المجموعة المسماة CJK Unified Ideographs Extension F (2CEB0–2EBEF) على 7473 حرفًا في النطاق من U+2CEB0 إلى 2EBE0، والتي أُضيفت في يونيكود 10.0 (2017). وتشمل أكثر من 1000 حرف من حروف Sawndip الخاصة بلغة Zhuang .

الرسوم البيانية

2CEB0–2EBEF .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (8015) أكبر من عدد الأحرف المشفرة (7473). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة G

تمت إضافة كتلة تسمى CJK Unified Ideographs Extension G كجزء من Unicode 13.0 إلى المستوى الإيديوغرافي الثالثي في ​​النطاق من U+30000 إلى U+3134F، وتحتوي على 4939 حرفًا. [ 25 ]

الرسوم البيانية

30000–3134F .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (5239) أكبر من عدد الأحرف المشفرة (4939). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة H

تمت إضافة كتلة تسمى CJK Unified Ideographs Extension H كجزء من Unicode 15.0 إلى المستوى الإيديوغرافي الثالثي في ​​النطاق من U+31350 إلى U+323AF، وتحتوي على 4192 حرفًا. [ 26 ]

الرسوم البيانية

31350–323AF .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، لذا فإن مجموع عدد الأحرف الفردية (4541) أكبر من عدد الأحرف المشفرة (4192). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة ١

تمت إضافة كتلة تسمى CJK Unified Ideographs Extension I كجزء من Unicode 15.1 إلى المستوى الإيديوغرافي التكميلي في النطاق من U+2EBF0 إلى U+2EE5F، وتحتوي على 622 حرفًا. [ 27 ]

الرسوم البيانية

2EBF0–2EE5F .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، مما يجعل مجموع عدد الأحرف الفردية (625) أكبر من عدد الأحرف المشفرة (622). [ 22 ]

امتداد الرموز الصينية واليابانية والكورية الموحدة J

تمت إضافة كتلة تسمى CJK Unified Ideographs Extension J كجزء من Unicode 17.0 إلى المستوى الإيديوغرافي الثالثي في ​​النطاق U+323B0-U+33479، وتحتوي على 4298 حرفًا.

الرسوم البيانية

323B0–3347F .

مصادر

ملاحظة: تظهر بعض الأحرف في أكثر من مصدر، مما يجعل مجموع عدد الأحرف الفردية (4406) أكبر من عدد الأحرف المشفرة (4298). [ 22 ]

رموز التوافق مع لغات CJK

تم إنشاء الكتلة المسماة CJK Compatibility Ideographs (F900–FAFF) للحفاظ على التوافق المتبادل مع المعايير الأخرى.

مع ذلك، فإن اثني عشر حرفًا في هذه المجموعة تمتلك خاصية "الرسم الموحد": U+FA0E 﨎، U+FA0F 﨏، U+FA11 﨑، U+FA13 﨓، U+FA14 﨔، U+FA1F 﨟، U+FA21 﨡، U+FA23 﨣، U+FA24 﨤، U+FA27 﨧، U+FA28 﨨، وU+FA29 﨩. [ 1 ] لا يرتبط أي من الأحرف الأخرى في هذه المجموعة أو مجموعات "التوافق" الأخرى بتوحيد لغات الصين واليابان وكوريا.

بينما لا يعتبر 龜 و 亀 قابلين للتوحيد، فإن U+FA20CJK COMPATIBILITY IDEOGRAPH-FA20 يعتبر نسخة مكررة من U+8612CJK UNIFIED IDEOGRAPH-8612 .

الرسوم البيانية

F900–FAFF .

مصادر

ملاحظة: تظهر جميع الأحرف في أكثر من مصدر واحد، لذا فإن مجموع عدد الأحرف الفردية (40) أكبر من عدد الأحرف المشفرة (12). [ 22 ]

المشاكل المعروفة

التفكك

U+4039

كان الحرف U+4039 (䀹) عبارة عن دمج لحرفين مختلفين (أحدهما بصوت jiā夾 والآخر بصوت shǎn㚒) حتى إصدار Unicode 5.0. ومع ذلك، فقد كانا حرفين مختلفين معجميًا، وكان من غير المناسب دمجهما؛ إذ لهما نطق مختلف ومعانٍ مختلفة.

تم قبول اقتراح عدم توحيد U+4039 [ 28 ] لـ Unicode 5.1، حيث تم ترميز حرف جديد في U+9FC3 (鿃) لتمثيل shǎn.

ثلاثة رموز أخرى في الامتداد ب

في ملحق الأحرف الصينية واليابانية والكورية الموحد B، تم دمج بعض الأحرف بشكل خاطئ مع أحرف أخرى. تشمل هذه الأحرف U+2017B (⠅�) وU+204AF (⠒�) وU+24CB2 (⤲�). احتوى الحرفان الأولان على دمج خاطئ بين المصدرين الصيني والفيتنامي لشكلها، بينما دمج الحرف الأخير بين المصدرين الصيني والتايواني. [ 29 ]

تم تصحيح الرموز الرسومية لـ U+2017B (𠅻) و U+204AF (𠒯) ​​في الإصدار 10.0، وتمت إزالة الرمز الرسومي الخاطئ UCS2003 المصدر U+24CB2 (𤲲) في الإصدار 13.0.

المتغيرات القابلة للتوحيد والنسخ المتطابقة

كذلك، في امتداد الأحرف الصينية واليابانية والكورية الموحد B، تم ترميز مئات من أشكال الأحرف الرسومية عن طريق الخطأ. [ 30 ] بالإضافة إلى ذلك، وجد تقرير صادر عن اللجنة الفنية المشتركة 1/اللجنة الفرعية 2 التابعة للمنظمة الدولية للمعايير/اللجنة الكهروتقنية الدولية أن ستة أحرف متطابقة تمامًا (حيث تم ترميز الحرف نفسه مرتين عن غير قصد) وحرفين شبه متطابقين (حيث يمثل حرف CJK-B في الواقع فصلًا فعليًا لشكلين من أشكال الأحرف الرسومية الموحدة في حرف BMP المقابل) قد تم ترميزها عن طريق الخطأ: [ 31 ]

  • U+34A8 㒨 = U+20457 𠑗  : الرمز U+20457 هو نفسه الرمز الصيني للرمز U+34A8، ولكنه يختلف اختلافًا كبيرًا عن الرمز التايواني للرمز U+34A8.
  • U+3DB7 㶷 = U+2420E 𤈎  : نفس أشكال الرموز الرسومية
  • U+8641 虁 = U+27144 𧅄  : الرمز U+27144 هو نفسه الرمز الكوري للرمز U+8641، ولكنه يختلف اختلافًا كبيرًا عن الرموز الصينية والتايوانية واليابانية للرمز U+8641.
  • U+204F2 𠓲 = U+23515 𣔕  : نفس أشكال الرسوم، ولكنها مرتبة تحت جذور مختلفة
  • U+249BC 𤦼 = U+249E9 𤧩  : نفس أشكال الرموز
  • U+24BD2 𤯒 = U+2A415 𪐕  : نفس أشكال الرسوم، ولكنها مرتبة تحت جذور مختلفة
  • U+26842 �2 = U+26866 𦡦  : نفس أشكال الرموز الرسومية
  • U+FA23 﨣 = U+27EAF 𧺯  : نفس أشكال الرسوم (U+FA23 﨣 هو رمز صيني ياباني كوري موحد، على الرغم من اسمه "رمز التوافق الصيني الياباني الكوري - FA23".)

رموز صينية يابانية كورية أخرى في يونيكود، وليست موحدة.

إلى جانب مجموعات "الأحرف الصينية الموحدة" الإحدى عشرة، يحتوي يونيكود على نحو اثنتي عشرة مجموعة أخرى تضم أحرفًا صينية يابانية كورية غير موحدة. وتشمل هذه الأحرف بشكل رئيسي الجذور والخطوط وعلامات الترقيم والرموز وأحرف التوافق الصينية اليابانية الكورية. ورغم أن بعض الأحرف لها نظائر (قابلة للتحليل) في مجموعات أخرى، إلا أن استخداماتها قد تختلف. ومن الأمثلة على الأحرف الصينية اليابانية الكورية غير الموحدة الحرف U+3007 ، وهو الرقم الصيني صفر، الموجود في مجموعة الرموز وعلامات الترقيم الصينية اليابانية الكورية . ورغم أنه غير مدرج ضمن "الأحرف الصينية اليابانية الموحدة"، إلا أنه يُعامل كحرف صيني ياباني كوري لجميع الأغراض الأخرى. [ 32 ]

تم تضمين أربع مجموعات من أحرف التوافق لضمان التوافق مع أنظمة معالجة النصوص القديمة ومجموعات الأحرف الأقدم:

تتضمن هذه الأحرف أشكالاً خاصة بتنسيق النصوص العمودية وأحرفاً خاصة بالنصوص المنسقة، والتي توصي يونيكود بمعالجتها بوسائل أخرى. لذا، يُنصح بعدم استخدامها.

قاعدة بيانات أونيهان

توفر قاعدة بيانات Unihan، التي يديرها اتحاد Unicode، معلوماتٍ شاملةً عن جميع أحرف الهان الموحدة المُشفّرة في معيار Unicode، بما في ذلك ربطها بمعايير وطنية وصناعية مختلفة، وفهارسها في القواميس القياسية، وأنواعها المُشفّرة، ونطقها بلغاتٍ متعددة، وتعريفها باللغة الإنجليزية. تُتاح قاعدة البيانات للجمهور كملفات نصية [ 33 ] وعبر موقع إلكتروني تفاعلي [ 34 ] [ 35 ] . يتضمن الموقع أيضًا رموزًا وتعريفاتٍ للكلمات المركبة مُستقاة من مشروعي قاموس EDICT الياباني والصيني المجانيين ( وهما مُقدّمان للتسهيل فقط، وليسا جزءًا رسميًا من معيار Unicode).

دعم الخطوط

تدعم معظم خطوط CJK مجموعتي الأحرف الصينية واليابانية والكورية الموحدة (CJK Unified Ideographs) وامتداد الأحرف الصينية واليابانية والكورية الموحدة A، باعتبارهما جزءًا من المستوى الأساسي متعدد اللغات . مع ذلك، تحتوي الخطوط اليابانية والكورية عادةً على عدد أحرف أقل (حوالي 13000 و8000 حرف على التوالي) من الخطوط الصينية. أما الامتدادات B وC وD، فتدعمها خطوط إضافية هي MingLiU-ExtB وMingLiU_HKSCS-ExtB وPMingLiU-ExtB وSimSun-ExtB، المضمنة في نظام التشغيل Microsoft Windows منذ Vista. [ 36 ]

تاريخ إصدارات يونيكود

انظر أيضاً

ملحوظات

  1. من المفترض أن تكون الأحرف مخصصة للأحرف الصينية السنغافورية ، ولكن يبدو أنها مجموعة مخصصة وليست معيارًا وطنيًا سنغافوريًا . [ 24 ]

مراجع

  1. 1 2 "Unicode PropList.txt" . 30-06-2025 . تم الاسترجاع في 11-09-2025 .
  2. "الأسئلة الشائعة - الصينية واليابانية" . أسئلة شائعة حول يونيكود . مؤرشف من الأصل في 30 ديسمبر 2025. تم الاطلاع عليه في 20 يناير 2026 .
  3. منسق مجموعة العمل الدولية (10-12-2024). "قائمة خبراء مجموعة العمل الدولية" . ISO/IEC JTC1 / SC2 /WG2/ IRG N2769.
  4. لوندي، كين (13-09-2024). "تقرير أنشطة الولايات المتحدة/يونيكود لاجتماع مجموعة العمل الدولية رقم 63" (ملف PDF) . ISO/IEC JTC1 / SC2 /WG2/ IRG N2700.
  5. "Unihan_IRGSources.txt" . 24-07-2025 . تم الاطلاع عليه بتاريخ 12-09-2025 .
  6. "UAX #45: رموز U-source" . اتحاد يونيكود. 2025-07-24.
  7. "18.1.7. ترتيب الأحرف الصينية الصينية" . معيار يونيكود: المواصفات الأساسية . الإصدار 16.0.0. اتحاد يونيكود .
  8. 1 2 "3.3. مؤشرات القاموس" . قاعدة بيانات يونيكود هان (Unihan) . UAX #38. تمثل ثلاث من خصائص القاموس مؤشرات IRG الرسمية للقواميس المستخدمة في خوارزمية فرز القواميس الأربعة. لا يزال اثنان منها ( و ) مستخدمين من قبل IRG، بينما لم يعد الثالث ( ) مستخدمًا.kIRGHanyuDaZidiankIRGKangXikIRGDaeJaweon
  9. لوندي، كين (2022-09-01). "اقتراح لإزالة/تحسين خصائص قاعدة بيانات Unihan المؤقتة" (ملف PDF) . ص 6. UTC L2/22-188. إضافةً إلى ذلك، لم يعد فريق IRG يستخدم هذا القاموس في أعماله الجارية. 
  10. ^ "kIRG_GSource" . قاعدة بيانات يونيكود هان (Unihan) . يواكس #38. GKX: إيدوغرافات قاموس كانغشي (康熙字典) الطبعة التاسعة (1958) بما في ذلك الملحق (康熙字典)補遺. GHZ: إيديوغرافات هانيو الدازيدية (漢語大字典).
  11. ^ لوند ، كين (22/02/2018). "التغييرات والتصحيحات المقترحة لـ kIRG_GSource" (PDF) . UTC L2/18-065؛ ISO/IEC JTC1 / SC2 /WG2/ IRG N2297.
  12. "2. بيانات ملف نصي" . رموز U-Source . اتحاد يونيكود . UAX #45. فهرس قاموس KangXi للرمز، كما هو موضح في الملحق رقم 38 من معيار يونيكود، "قاعدة بيانات يونيكود هان (Unihan)" [UAX38]. لم يعد هذا الحقل مستخدمًا ولا يحتوي على أي بيانات.
  13. لوندي، كين (30-09-2024). "اقتراح لإزالة قيمة FS (الضربة المتبقية الأولى) من الطلبات" (ملف PDF) . ISO/IEC JTC1 / SC2 /WG2/ IRG N2713. تقترح هذه الوثيقة إزالة تضمين قيم الضربة المتبقية الأولى (المعروفة أيضًا باسم FS) من متطلبات تقديم الأحرف الصينية واليابانية والكورية الموحدة الجديدة [...] يستخدم محرر مشروع ISO/IEC 10646، عند تجميع مجموعة عمل IRG في كتلة امتداد جديدة للأحرف الصينية واليابانية والكورية الموحدة، قيم FS لفرز الأحرف التي تشترك في نفس قيمة الجذر-الضربة (الجذر + SC).
  14. ^ لوند ، كين (2012/09/16). "أورو" . مدونة نوع CJK . شركة أدوبي .
  15. معيار يونيكود 4.0، الملحق أ - تاريخ توحيد اللغة الصينية
  16. سوزان توبينغ، "الحياة السرية لليونيكود" . مؤرشف من الأصل بتاريخ 14 نوفمبر 2007. تم الاطلاع عليه بتاريخ 12 مايو 2010 .{{cite web}}: CS1 maint: bot: حالة عنوان URL الأصلي غير معروفة ( رابط )
  17. لو، تشين (2015-06-08). "مجموعة الأحرف المقترحة لهونغ كونغ" (ملف PDF) . ISO/IEC JTC1 / SC2 /WG2/ IRG N2074.
  18. " الفصل 11 - نصوص شرق آسيا معيار يونيكود، 4.0 .
  19. "قاعدة بيانات التباين الإيديوغرافي" . 13-09-2022 . تم الاسترجاع في 20-09-2022 .
  20. "إحصائيات التشخيص المختبري" . 14-07-2025 . تم الاطلاع عليه بتاريخ 12-09-2025 .
  21. PRI 108: التسجيل المدمج لمجموعة Adobe Japan1 وللتسلسلات الموجودة في تلك المجموعة
  22. 1 2 3 4 5 6 7 8 9 10 11 12 "Unihan_IRGSources.txt (من Unihan.zip)" . 24-07-2025 . تم الاطلاع عليه بتاريخ 12-09-2025 .
  23. 1 2 3 4 5 6 7 8 9 10 11 12 " UAX #38: قاعدة بيانات يونيكود هان (Unihan)" . اتحاد يونيكود.
  24. لوندي، كين (2009). "الفصل 3: معايير مجموعة الأحرف § معايير مجموعة الأحرف الصينية - سنغافورة". معالجة معلومات CJKV ( الطبعة الثانية). سيباستوبول، كاليفورنيا: أورايلي ميديا، ص 130. ISBN   978-0-596-15611-4OCLC 317878469. لا أعرف، على الأقل بالنسبة لي ، مدى كون هذه الأحرف الـ 226 مُخصصة أو مُقننة وفقًا لمعيار وطني سنغافوري. أظن أنها مُخصصة ببساطة لعدم وجود أي معيار وطني سنغافوري واضح. 
  25. "يونيكود 13.0.0" . 10 مارس 2020. تم الاطلاع عليه في 10 مارس 2020 .
  26. "يونيكود 15.0.0" . 13 سبتمبر 2022. تم الاطلاع عليه بتاريخ 14 سبتمبر 2022 .
  27. "Unicode 15.1.0" . 2023-09-12 . تم الاطلاع عليه بتاريخ 2023-09-12 .
  28. أندرو ويست وجون جينكينز، اقتراح تفكيك U+4039
  29. إيسو تشان (陈永聪)، تعليقات على أربعة رموز خاطئة في الأحرف الصينية واليابانية والكورية الموحدة Ext B & E.
  30. تايتشي كاواباتا. "IRGN1155 نسخ مكررة محتملة" (.zip) . تم الاسترجاع في 22-06-2019 .
  31. كوك، ريتشارد (6 أكتوبر 2003). "تقرير عن عيوب في نماذج CJK المشفرة المكررة" (ملف PDF) . ISO/IEC JTC1/SC2/WG2 . تاريخ الاسترجاع: 21 أغسطس 2025 .
  32. GB/T 15835-2011《出版物上数字用法》. الصين جوجيا بياو تشون. https://journals.usst.edu.cn/uploadfile/file/GBT%2015835-2011%E3%80%8A%E5%87% BA%E7%89%88%E7%89%A9%E4%B8%8A%E6%95%B0%E5%AD%97%E7%94%A8%E6%B3%95%E3%80%8B.pdf
  33. "Unihan.zip" . معيار يونيكود . اتحاد يونيكود.
  34. "البحث في قاعدة بيانات Unihan" . معيار Unicode . اتحاد Unicode.
  35. "البحث في قاعدة بيانات Unihan: مثال على البحث عن 中" . معيار Unicode . اتحاد Unicode.
  36. ^ لوند ، كين (2009). معالجة معلومات CJKV . أورايلي. ص 633 – 634. ISBN  978-0-596-51447-1.