التقييم الإدراكي لجودة الصوت
يُعدّ التقييم الإدراكي لجودة الصوت ( PEAQ ) خوارزمية معيارية لقياس جودة الصوت المُدرَكة بموضوعية ، طُوِّرت بين عامي 1994 و1998 من قِبَل فريق عمل مشترك من الخبراء ضمن المجموعة 6Q التابعة لقطاع الاتصالات الراديوية في الاتحاد الدولي للاتصالات ( ITU-R ). صدرت الخوارزمية في الأصل كتوصية ITU-R رقم BS.1387 عام 1998، وجرى تحديثها آخر مرة عام 2023. تستخدم الخوارزمية برمجيات لمحاكاة الخصائص الإدراكية للأذن البشرية ، ثم تُدمج متغيرات مُخرجات النموذج المتعددة في مقياس واحد.
يُصنِّف مؤشر PEAQ جودة الصوت المُدرَكة كما يفعل المشاركون في اختبار استماع وفقًا لمعيار ITU-R BS.1116. وتُحاكي نتائج PEAQ بشكل أساسي متوسط درجات الرأي التي تغطي مقياسًا من 1 (سيئ) إلى 5 (ممتاز). ويُعرَّف مُعامل الفرق الذاتي (SDG)، الذي يقيس درجة تلف الضغط (الضعف)، بأنه الفرق بين درجات الرأي للنسخة المختبرة والنسخة المرجعية (المصدر). ويتراوح مُعامل SDG عادةً من 0 (لا يوجد ضعف مُدرَك) إلى -4 (ضعف شديد). أما مُعامل الفرق الموضوعي (ODG) فهو الناتج الفعلي للخوارزمية، وهو مُصمَّم ليُطابق مُعامل SDG. [ 1 ]
| وصف الإعاقة | BS.1284 الدرجة [ 2 ] | ODG |
|---|---|---|
| غير محسوس | 5.0 | 0.0 |
| ملحوظ، لكنه ليس مزعجاً | 4.0 | -1.0 |
| مزعج بعض الشيء | 3.0 | -2.0 |
| مزعج | 2.0 | -3.0 |
| مزعج للغاية | 1.0 | -4.0 |
تحفيز
أدت الحاجة إلى ترشيد استهلاك النطاق الترددي إلى تطوير تقنيات ضغط البيانات الصوتية المراد إرسالها. تعمل طرق التشفير المختلفة على إزالة كل من التكرار والبيانات غير ذات الصلة بالإدراك في الإشارة الصوتية، مما يقلل بشكل كبير من معدل البتات المطلوب لتشفير الإشارة. وتأخذ هذه الطرق في الحسبان معرفة الإدراك السمعي البشري، وعادةً ما تحقق معدل بتات منخفضًا بتجاهل المعلومات الصوتية التي من غير المرجح أن يسمعها معظم المستمعين. لا ترتبط قياسات الصوت التقليدية، مثل استجابة التردد القائمة على المسح الجيبي، ونسبة الإشارة إلى الضوضاء، والتشويه التوافقي الكلي + الضوضاء، بالضرورة بجودة برنامج ترميز الصوت . لذا، يجب استخدام نموذج نفسي صوتي للتنبؤ بكيفية حجب المعلومات بواسطة محتوى صوتي أعلى صوتًا مجاور لها في الزمن والتردد.
نظراً لأن اختبارات الاستماع الذاتية تستغرق وقتاً طويلاً ومكلفة وغير عملية للاستخدام اليومي، فقد كان من المفيد استبدالها بأساليب موضوعية تعتمد على الحاسوب. وبتوجيه من فريق العمل 6Q التابع لقطاع الاتصالات الراديوية في الاتحاد الدولي للاتصالات، طوّر فريق من كبار خبراء جودة الصوت نموذجاً موضوعياً جديداً لجودة الصوت: PEAQ. وكان من بين المساهمين في هذا النموذج:
- شركة أوبتيكوم المحدودة، إرلانجن، ألمانيا
- معهد فراونهوفر للدوائر المتكاملة، IIS-A، إرلانجن، ألمانيا
- دويتشه تيليكوم بيركوم، برلين، ألمانيا
- جامعة برلين ، برلين، ألمانيا
- معهد فور Rundfunktechnik ، IRT، ميونيخ، ألمانيا
- أبحاث KPN ، مختبر الدكتور نهير، لايدسندام، هولندا
- المركز المشترك لدراسات التلفزيون والاتصالات ، فرنسا
- مركز أبحاث الاتصالات، أوتاوا، كندا
مبادئ
في الترميز الإدراكي، من الضروري تحديد مستوى التشويش الذي يمكن إدخاله في الإشارة قبل أن تصبح مسموعة. ولأن الجهاز السمعي البشري غير خطي إلى حد كبير، فإن مستويات التشويش تتغير بتغير الزمن وخصائص التردد للإشارة الصوتية. يمكن للدراسات النفسية الصوتية أن توفر معايير عتبة لمختلف الأحداث الصوتية والأصوات المسموعة الناتجة عنها. يكمن جوهر الأمر في الحجب ، الذي يصف تأثير صوت ما على صوت آخر متزامن. يعتمد الحجب على التركيب الطيفي لكل من إشارة الحجب وإشارة الصوت المُحجب، وعلى تغيرات أخرى مع الزمن. يوضح الشكل المخطط الأساسي لنظام الترميز الإدراكي.

تُحلل إشارة الإدخال إلى مكونات طيفية مُعاد أخذ عينات منها. ولكل عينة، يُستخلص تقدير لعتبة الحجب الفعلية باستخدام قواعد معروفة من علم النفس الصوتي. هذا هو النموذج الإدراكي لنظام التشفير. تُكمّم المكونات الطيفية وتُشفّر، مع الحفاظ على ضوضاء التكميم دون عتبة الحجب. وأخيرًا، تتشكل سلسلة البتات .
يعتمد تحليل النتائج على درجة الاختلاف الذاتي . ويقارن الإشارة قيد الاختبار بالإشارة المرجعية الأصلية.
نماذج
يتبع النموذج الخصائص الأساسية للجهاز السمعي، ويُفرّق بين مراحل التأثيرات الفيزيولوجية والنفسية الصوتية. يُحاكي الجزء الأول بناء الإشارة باستخدام تحويل فورييه المنفصل ومجموعة من المرشحات. أما الجزء الثاني، فيُحاكي المعالجة الإدراكية كما يفعل الدماغ البشري. تُمثل الصورة التالية مخططًا بسيطًا للعلاقة بين الجهاز السمعي البشري ونموذج نفسي صوتي موضوعي.

من خلال مقارنة نموذج الإشارة التجريبية مع الإشارة المرجعية (الأصلية)، يتم استخلاص عدد من متغيرات خرج النموذج. قد يقيس كل متغير من متغيرات خرج النموذج أبعادًا نفسية صوتية مختلفة. في المرحلة النهائية، تُدمج متغيرات خرج النموذج باستخدام شبكة عصبية (بأوزان محددة وفقًا للمعيار) لإنتاج نتيجة تراعي التقييم الذاتي للجودة.
يوجد نوعان من النموذج. تم تطوير النسخة الأساسية (الأقل استهلاكًا للموارد الحاسوبية) لتكون سريعة بما يكفي للمراقبة الآنية، وتستخدم فقط تحويل فورييه السريع (FFT). أما النسخة المتقدمة فهي أكثر استهلاكًا للموارد الحاسوبية، وقد تُقدم نتائج أكثر دقة؛ إذ تستخدم تحويل فورييه السريع (FFT) ومجموعات المرشحات لإنتاج المزيد من قيم MOV التي تعمل عليها الشبكة العصبية.
رخصة
إن تقنية PEAQ كما أوصت بها ITU-R Rec. BS.1387 محمية بالعديد من براءات الاختراع ومتاحة بموجب ترخيص مع الكود الأصلي للتطبيقات التجارية وفقًا لشروط الاتحاد الدولي للاتصالات العادلة والمعقولة وغير التمييزية .
تطبيقات خالية من حقوق الملكية
- تم إيقاف تطبيق مبكر مفتوح المصدر للنموذج الأساسي، والذي أطلق عليه اسم EAQUAL، في عام 2002 بسبب دعاوى انتهاك براءات الاختراع.
- لأغراض تعليمية، يوجد برنامج مجاني متعدد المنصات يُسمى Peaqb، يؤدي الوظائف نفسها بشكل محدود، إذ لم يتم التحقق من صحته باستخدام بيانات الاتحاد الدولي للاتصالات. وقد أظهر تقييم أجراه مؤلفو GstPEAQ قيمة جذر متوسط مربع الخطأ (RMSE) قدرها 0.2063 لـ 16 متجه اختبار من الاتحاد الدولي للاتصالات. [ 3 ]
- يتوفر تطبيق آخر غير مُدقَّق لنموذج PEAQ الأساسي للاستخدام التعليمي، وهو PQevalAudio، من مختبر TSP بجامعة ماكجيل. وقد أظهر تقييم مؤلفي GstPEAQ قيمة RMSE قدرها 0.2329 لـ 16 متجه اختبار من الاتحاد الدولي للاتصالات. [ 3 ]
- يُطبّق برنامج GstPEAQ كلاً من النموذج الأساسي والمتقدم، ولكنه لا يلتزم بمعايير التفاوت المسموح بها في معيار BS.1387-1. ومع ذلك، فإن الفرق عن المطابقة (RMSE 0.2009 في الوضع الأساسي) أقل من تطبيقات المصادر المفتوحة السابقة. كما وجد المؤلف أن هذا الفرق غير ذي دلالة إحصائية عند استخدام ODG كتقدير لـ SDG. [ 3 ]
انظر أيضاً
مراجع
- ↑ التوصية ITU-R BS.1387-2، الصفحات 10-11
- ↑ توصية الاتحاد الدولي للاتصالات BS.1284
- 1 2 3 هولترز، مارتن؛ زولزر، أودو (2015). GstPEAQ - تطبيق مفتوح المصدر لخوارزمية PEAQ . المؤتمر الدولي الثامن عشر حول المؤثرات الصوتية الرقمية (DAFx-15). تروندهايم، النرويج.
للمزيد من القراءة
- توصية الاتحاد الدولي للاتصالات الراديوية BS.1387 : طريقة القياسات الموضوعية لجودة الصوت المدركة (PEAQ)
- توصية الاتحاد الدولي للاتصالات الراديوية BS.1116 : طرق التقييم الذاتي للعيوب الطفيفة في أنظمة الصوت، بما في ذلك أنظمة الصوت متعددة القنوات
- توصية الاتحاد الدولي للاتصالات الراديوية BS.1534 : طريقة التقييم الذاتي لمستويات الجودة المتوسطة لأنظمة الترميز (MUSHRA)
- سبانياس ، أندرياس؛ بينتر، تيد؛ آتي، فينكاترامان (2007). "مقاييس الجودة لترميز الصوت الإدراكي". معالجة وترميز الإشارات الصوتية . وايلي-إنترساينس . ص 401. ISBN 978-0-47179147-8.
- سفيتش، نيديلكو؛ سيبانين، تابيو تابيو (2007). "التقييم الذاتي والموضوعي لجودة الصوت المُعَلَّم بالعلامات المائية". تقنيات وتكنولوجيات العلامات المائية الصوتية الرقمية . مجموعة آيديا. ص 270. ISBN 978-1-59904515-3.
- ديلجادو، بابلو م.؛ هير، يورغن (مايو 2020). هل ما زال بإمكاننا استخدام PEAQ؟ تحليل أداء معيار الاتحاد الدولي للاتصالات للتقييم الموضوعي لجودة الصوت المُدرَكة . المؤتمر الدولي الثاني عشر لجودة تجربة الوسائط المتعددة (QoMEX) لعام 2020. الصفحات 1-6 . arXiv : 2212.01467 . doi : 10.1109/QoMEX48832.2020.9123105 . – يجد أن PEAQ يتخلف عن الطرق الموضوعية الأخرى من حيث الدقة، لكن إعادة تدريب الشبكة العصبية MOV-to-ODG ينتج نموذجًا يتفوق على الطرق الموضوعية الأخرى
روابط خارجية
- الموقع الرسمي لـ PEAQ : http://www.peaq.org
- https://web.archive.org/web/20061207095623/http://www.crc.ca/en/html/aas/home/peaq/peaq موقع PEAQ في مركز الأبحاث الكندية
- https://web.archive.org/web/20090423074959/http://www.opticom.de/technology/technology.html معلومات PEAQ من OPTICOM
- http://elvera.nue.tu-berlin.de/files/0829Thiede1998.pdf PEAQ - der künftige ITU-Standard zur objektiven Messung der wahrgenommenen Audioqualität
- https://ieeexplore.ieee.org/document/1613524 IEEE - تقدير جودة نظام الصوت الإدراكي باستخدام خوارزمية PEAQ
- https://sourceforge.net/projects/peaqb/ مشروع Peaqb
- http://www-mmsp.ece.mcgill.ca/Documents/Software/index.html PQevalAudio - تطبيق Matlab و C لنموذج PEAQ الأساسي.
- http://www.mp3-tech.org/programmer/sources/eaqual.tgz شفرة المصدر لبرنامج EAQUAL
- برامج ترميز الصوت
- الصوت الرقمي
- توصيات الاتحاد الدولي للاتصالات الراديوية
