ISO 11940
ISO 11940 هو معيار ISO لترجمة الأحرف التايلاندية ، نُشر عام 1998، وجرى تحديثه في سبتمبر 2003، وأُقرّ عام 2008. ومن أبرز استخدامات هذا المعيار ترجمة جوجل. ويُعرّف ملحقٌ لهذا المعيار، يُسمى ISO 11940-2 ، نسخةً مبسطةً منه.
الحروف الساكنة
| تايلاندي | ก | ข | ฃ | ค | ฅ | ฆ | ง | จ | ฉ | ช | ซ | ฌ | ญ |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| ISO | ك | k̄h | ḳ̄h | kh | k̛h | ḳh | ng | ج | c̄h | ch | s | c̣h | ỵ |
| تايلاندي | ฎ | ฏ | أو | ฑ | ฒ | ณ | ด | ต | ถ | ت | ت | ن | |
| ISO | د | ṭ | ذ | ذ | ذ | ṇ | د | ت | ذ | ذ | ذ | ن | |
| تايلاندي | ب | ป | ผ | ฝ | พ | ฟ | ภ | ม | |||||
| ISO | ب | ص | p̄h | f̄ | درجة الحموضة | و | الرقم الهيدروجيني | م | |||||
| تايلاندي | ย | ร | ฤ | ล | ฦ | ว | ศ | ษ | س | ห | ฬ | อ | ฮ |
| ISO | y | ر | v | ل | ł | w | ص̄ | s̛̄ | s̄ | h̄ | ḷ | x | ḥ |
تُشتق ترجمة الحروف الساكنة النقية من نطقها المعتاد كحرف ساكن ابتدائي. يُستخدم حرف الهاء غير المميز لتكوين حروف مركبة تدل على الحروف الساكنة المهموسة . يتم التمييز بين أزواج الحروف الساكنة العالية والمنخفضة بشكل منهجي عن طريق وضع علامة المد على الحرف الساكن العالي. يُمكن التمييز بشكل أكبر بين الحروف الساكنة ذات الوظيفة الصوتية المتطابقة عن طريق ترك الحرف الأكثر شيوعًا بدون علامة، ووضع نقطة أسفل الحرف الثاني الأكثر شيوعًا، ووضع علامة على الحرف الثالث الأكثر شيوعًا، ووضع خط تحت الحرف الرابع الأكثر شيوعًا. يُشابه استخدام النقطة أسفل الحرف الممارسة الهندية في تمييز الحروف الساكنة المنعكسة بوضع نقطة أسفلها، ولكن هناك اختلافات دقيقة - فالنقاط أسفل ترجمات ธ(tho) وศ ( so) هي التي تُوضع أسفلها، وليس ترجمات الحروف الساكنة المنعكسة المقابلة . يجب إدخال ترجمات الحروف الساكنة بالترتيب التالي: الحرف الأساسي، ثم علامة المد إن وجدت، ثم النقطة أسفل الحرف، ثم علامة المد أو علامة المد أسفل الحرف الأول. ثلاثة أحرف ساكنة فقط تحتوي على القرن في ترجمتها الصوتية، وهي ฅkho khon و ฒtho phuthao و ษso ruesi ، وحرف ساكن واحد فقط يحتوي على خط تحته، وهو ฑtho nang montho .
حروف العلة
| تايلاندي | ะ | ◌ั | า | ำ | ◌ิ | ◌ี | ◌ึ | ◌ื | ◌ุ | ◌ู | เ | แ | โ | ใ | ไ | ฤ | ฤๅ | ฦ | ฦๅ | ย | ว | อ |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| ISO | أ | ạ | أ | å | أنا | أنا | ụ | ụ̄ | u | ū | هـ | æ | o | أنا | أنا | v | vɨ | ł | łɨ | y | w | x |
لم يُعرض حرف لاكخانغياو (ๅ) إلا مقترنًا بحرفي العلة ฤ وฦ. ويكتفي المعيار بذكر ฤ وฦ مع الحروف الساكنة، ولاكخانغياو مع حروف العلة. ويمكن أيضًا كتابة لاكخانغياو منفردًا بحرف "i" صغير مع خط ( ɨ )، ولكن لا يُفترض أن يظهر هذا في اللغات التايلاندية أو البالية أو السنسكريتية.
تم تضمين الترجمات الصوتية لـ วwo waen و อo ang هنا بسبب استخدامها كرموز حروف علة كاملة، ولكن ترجمتها الصوتية لا تعتمد على كيفية استخدامها، والمعيار ببساطة يسردها مع الحروف الساكنة.
يتم نقل رموز حروف العلة المركبة وفقًا لمكوناتها.
علامات تجارية أخرى مدمجة
| تايلاندي | –่ | –้ | –๊ | –๋ | –็ | –์ | –๎ | –ํ | –ฺ |
|---|---|---|---|---|---|---|---|---|---|
| ISO | –̀ | –̂ | –́ | –̌ | –̆ | –̒ | ~ | –̊ | –̥ |
لاحظ أن yamakkan (–๎) يتم تمثيلها بواسطة علامة التلدة المتباعدة، وليس علامة التلدة المرتفعة.
علامات الترقيم والأرقام
| تايلاندي | ๆ | ฯ | ๏ | ฯ | ๚ | ๛ | ๐ | ๑ | ๒ | ๓ | ๔ | ๕ | ๖ | ๗ | ๘ | ๙ |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| ISO | « | ǂ | § | ǀ | ǁ | » | 0 | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 | 9 |
يميز معيار ISO 11940:1998 بين رمز الاختصار paiyannoi (ฯ) ورمز إنهاء الجملة angkhandiao (ฯ)، على الرغم من أن معيار الأحرف الوطني TIS 620-2533 ولا إصدار Unicode 5.0 لا يميزان بينهما. يُنقل paiyannoi إلى اللغة الإنجليزية بالحرف ǂ، بينما يُنقل angkhandiao إلى اللغة الإنجليزية بالحرف ǀ . تجدر الإشارة إلى أن paiyannoi و angkhandiao و angkhankhu (๚) تُنقل باستخدام الأحرف المستخدمة في الحروف الساكنة النقرية ، وليس باستخدام علامات الخنجر المزدوجة أو الخطوط العمودية أو علامات الدنداس .
تسلسل الأحرف
بشكل عام، تُنقل الأحرف من اليسار إلى اليمين، وإذا كانت الأحرف لها نفس الموضع الأفقي، فمن الأعلى إلى الأسفل. في الواقع، يُحدد الترتيب الرأسي ببساطة بعلامات النبرة وعلامة ثانثاكات (-์) التي تسبق أي علامات أخرى أعلى أو أسفل الحرف الساكن. ينفي المعيار في نهاية القسم 4.2 إمكانية وجود تركيبة sara u (◌ุ, ◌ู) و nikkhahit (◌ํ)، ثم يُقدم مثالًا عليها عند تحديد نقل nikkhahit ، لكنه لا يُبين نقل هذه التركيبة. نتيجةً لهذه القواعد، باستثناء nikkhahit ، تُنقل جميع العلامات غير المتحركة الملحقة بحرف ساكن في اللغة التايلاندية إلى الحرف الساكن في النقل اللاتيني.
يُقر المعيار بأن محاولة نقل الحروف المتحركة والحروف الساكنة التي تسبق الحروف الأخرى قد تكون مريحة لأولئك الذين اعتادوا على الأبجدية الرومانية ، ولكنه يوصي بعدم نقل الحروف المتحركة التي تسبق الحروف الأخرى.
على سبيل المثال، ภาษาไทย ( RTGS : Phasa Thai ) يجب ترجمتها حرفيًا إلى p̣hās̛̄āịthy و เชียงใหม่ ( RTGS : Chiang Mai ) إلى echīyngıh̄m̀ .
الاختلافات
الأسباب
يحدد المعيار ترتيب كتابة علامات التشكيل، ولكن ليس بالضرورة أن تسجل جميع أنظمة الإدخال علامات التشكيل بنفس ترتيب كتابتها. يحدد يونيكود شكلين معياريين للأحرف التي تحتوي على علامات تشكيل متعددة، ومن المرجح أن يُخزن النص المترجم صوتيًا بأحد هذين الشكلين. هذا يُعقّد عملية الترجمة الصوتية العكسية التلقائية. ولأن العمليات المتوافقة مع يونيكود يجب أن تتعامل مع هذه الاختلافات بشكل صحيح، فقد تم اختيار الترجمات الصوتية في هذه الصفحة لسهولة العرض - قد تعرض أنظمة العرض الحالية الأشكال المكافئة بشكل مختلف.
تُظهر العديد من الخطوط تركيبات جديدة من الحروف الساكنة وعلامات التشكيل بشكل سيئ. على سبيل المثال، ينشر معهد اللغة الإستونية شرحًا لتطبيق المعيار على اللغة التايلاندية على الإنترنت، ويبدو أن هذا الشرح يلتزم بالمعيار باستثناء واحد. يتمثل هذا الاستثناء في أن علامات التشكيل فوق الحروف الساكنة، باستثناء علامة المد، تُزاح إلى اليمين، مما يوحي بأنها مُدخلة كأحرف غير مركبة مقابلة. يُحدد المعيار عمليات النقل الصوتي بوحدات الترميز، ولكن يمكن لأي شخص يعمل بناءً على هذا الشرح المجاني أن يستنتج بسهولة أنه ينبغي استخدام أشكال التباعد لعلامات التشكيل الصوتية.
وحدة العناية المركزة (CLDR 1.4.1)
يستخدم تطبيق ICU ، المُسجّل في الإصدار 1.4.1 من مستودع بيانات اللغة المشتركة برعاية يونيكود ، [ 1 ] علامة الفتحة (') بدلاً من علامة القرن (') في نقل الحروف الساكنة. يؤثر هذا على نقل الحروف ฅ ( kho khon) ، وฒ ( tho phuthao) ، وษ(so bo ruesi) . كما يُنقل الحرف ฏ ( to patak) بشكل مختلف، حيث يُكتب t̩ بدلاً من ṭ .
يختلف تطبيق وحدة العناية المركزة عن معيار المنظمة الدولية للتوحيد القياسي (ISO) في بعض الجوانب الطفيفة:
| تايلاندي | ISO | وحدة العناية المركزة | تعليق |
|---|---|---|---|
| ำ | å | ả | لتجنب الغموض مع التسلسل ะํ ( ะ + ◌ํ , a + ◌̊ ). |
| ◌ฺ | ◌̥ | ˌ | لتجنب مشاكل توحيد ترميز يونيكود . |
| ฯ | ǂ | ‡ | بما أن تطبيق ICU يستخدم Unicode، فإنه لا يستطيع التمييز بشكل موثوق بين angkhandiao و paiyannoi بدون تحليل دلالي، ولا يقوم بمثل هذه المحاولة. |
| ฯ | ǀ | ||
| ๚ | ǁ | | | | |
يختلف تسلسل الأحرف في تطبيق وحدة التحكم المتكاملة (ICU). فهو يُبدّل حروف العلة التي تسبقها بحرف ساكن، ويعالج العلامات على الحرف الساكن بالترتيب الذي تُخزّن به في الذاكرة. (تضمن معظم طرق إدخال اللغة التايلاندية تخزين العلامات من الأسفل إلى الأعلى). ولا يُبدّل حروف العلة التي تسبقها بمجموعات حروف ساكنة كاملة؛ إذ لا يمكن تحديد مجموعات الحروف الساكنة بدقة تامة، كما أن تبديل حروف العلة مع مجموعات الحروف الساكنة يتطلب رمزًا إضافيًا للسماح بالتحويل الموثوق إلى الكتابة التايلاندية.
على سبيل المثال، في ظل هذا التنفيذ، ภาษาไทย يترجم حرفيًا إلى p̣hās̄ʹāthịy و เชียงใหม่ إلى cheīyngh̄ım̀ .
وأخيرًا، يقوم هذا التطبيق بإنشاء عمليات نقل صوتي في نموذج توحيد يونيكود C (NFC).
انظر أيضاً
مراجع
- ↑https://unicode.org/Public/cldr/1.4.1/core.zip files transforms/ThaiLogical-Latin.xml and transforms/Thai-ThaiLogical.xml (used by ICU's transliterators "Thai-Latin" and "Latin-Thai")
External links
- ISO standards
- ISO romanization
- Romanization of Thai
