متوفر أيضًا بلغات أخرى: English · Español · Português · Français
رموز اللغات
قائمة ISO 639 كاملةً بصور الرموز الثلاث، وجوابٌ صريح عن أيّها يوضع في ترميز صفحتك.
ما رموز اللغات في ISO؟
رمز اللغة هو المعرِّف القصير الذي يوضع في خاصية lang في HTML، أو في اسم ملف، أو في ترويسة Accept-Language، أو في عمود قاعدة بيانات. وله ثلاث صور: فـISO 639-1 هي المعروفة ذات الحرفين، مثل ar وen وde. وISO 639-2 ثلاثية الأحرف وتغطي لغاتٍ أكثر بكثير. وISO 639-3 تمضي أبعد، إلى نحو سبعة آلاف لغة.
وهذه الصفحة تعدّد ISO 639-2 كاملةً، مأخوذةً من مكتبة الكونغرس مباشرةً، وهي جهة التسجيل لهذا المعيار. وهي 487 سطرًا: ستٌّ وثمانون وأربعمئة لغة، ومدخلٌ ليس لغةً البتة يشير إليه الجدول. ويعرض كل سطرٍ رمزه الثنائي إن وُجد، ورمزيه الثلاثيين، وأيّهما ينبغي استعماله.
وذلك العمود الأخير موجودٌ لأمرٍ يفعله المعيار ويفاجئ كثيرين: فلعشرين لغةً رمزان ثلاثيان مختلفان، كلاهما رسميٌّ ساري المفعول. وليس أحدهما خطأً مطبعيًّا ولا اسمًا قديمًا متروكًا.
كيف تستعمل هذه الصفحة؟
- ابحث بالاسم أو بأيٍّ من الرموز الثلاثة. فكتابةُ de أو ger أو deu أو «الألمانية» تصل إلى السطر نفسه، والاسمُ بلغتك كذلك. والمطابقاتُ التامة للرموز تتقدّم، وهذا مهم لأن is رمز الأيسلندية وهي في الوقت نفسه جزءٌ من عشرات الأسماء.
- علّم المرشِّح لترى العشرين الملتبسة وحدها. وهي اللغات التي يختلف فيها الرمزان الثلاثيان. والقائمة تحت الجدول تعرض كل زوجٍ جنبًا إلى جنب مع سبب الاختلاف.
- اقرأ عمود «استعمل هذا» وانسخ منه. فهو يعطي الرمز الثنائي متى وُجد، والرمزَ الاصطلاحي الثلاثي فيما عدا ذلك، وهو ما تشترطه BCP 47، فهو الذي يوضع في HTML وHTTP وكل ما يقرأه المتصفح.
لماذا لعشرين لغةً رمزان
يخصّص ISO 639-2 رموزه على مبدأين مختلفين، وهما لا يتفقان في عشرين لغة. فالرمز الببليوغرافي يتبع اسم اللغة بالإنجليزية: فالألمانية ger، والفرنسية fre، والصينية chi، والهولندية dut، والويلزية wel. وأما الرمز الاصطلاحي فيتبع اسم اللغة عند أهلها: فـDeutsch تعطي deu، وfrançais تعطي fra، وZhōngwén تعطي zho، وNederlands تعطي nld، وCymraeg تعطي cym.
والرموز الببليوغرافية قائمةٌ لأن فهارس المكتبات بُنيت عليها قبل أن يحتاج أحدٌ إلى وسم لغة صفحةٍ على الوِب بزمنٍ طويل، وتغييرها كان سيكسر كل فهرسٍ في الدنيا. والرموزُ الاصطلاحية قائمةٌ لأن تسمية اللغة بما يسميها به أهلها هو المبدأ الأصوب. فبقي الاثنان، فكلاهما ساري المفعول، وأيّهما «الصواب» متوقفٌ على أتفهرس كتابًا أم توسم وثيقة.
والعشرون هي: الألبانية والأرمنية والباسكية والبورمية والصينية والتشيكية والهولندية والفرنسية والجورجية والألمانية واليونانية والأيسلندية والمقدونية والملايوية والماورية والفارسية والرومانية والسلوفاكية والتبتية والويلزية. وسائر لغات المعيار، وهي ستٌّ وستون وأربعمئة، لكل واحدةٍ رمزٌ ثلاثي واحد ولا التباس فيها.
وثمة نمطٌ يستحق الالتفات وليس مصادفة: العشرون كلها لغاتٌ يختلف اسمها الإنجليزي اختلافًا بيّنًا عن اسمها عند أهلها. فلم يضطر أحدٌ إلى الاختيار بين رمزين لليابانية، لأن jpn تصلح من الطريقين جميعًا.
فأيّهما تستعمل حقًّا؟
أما في الوِب فلا هذا ولا ذاك: استعمل الرمز الثنائي. وليس هذا تفضيلًا، بل هو نص المواصفة. فـBCP 47، وهي المعيار الذي وراء خاصية lang في HTML وترويسة Accept-Language وكل واجهات اللغة في المتصفحات، تشترط أقصر وسمٍ متاح. فمتى كان للغةٍ رمزٌ في ISO 639-1 فذلك الرمز هو الوسم الصحيح وحده، والصورُ الثلاثية خطأٌ في هذا السياق ببساطة.
وبهذا يزول الالتباس كله، والسبب خاصيةٌ لا مصادفة: فاللغات العشرون ذوات الرمزين الثلاثيين لها جميعًا رمزٌ ثنائي أيضًا. ونحن نفحص هذا لا نقرّره، لأن استثناءً واحدًا يكسر القاعدة. فالوِب إذن لا يضطر قط إلى الاختيار بين ger وdeu: إنما يستعمل de، والصورتان الثلاثيتان كلتاهما تُردّان إليه بالضبط، وهذا أيضًا مما نتحقق منه.
ولا يبلغك الالتباس إلا إذا عملت بالرموز الثلاثية: في سجلات MARC، وبعض صيغ الترجمة المرئية، وقواعد المصطلحات القديمة، وكل ما بُني على عادة المكتبات. والعرفُ هناك ببليوغرافيٌّ غالبًا، والحزمُ أن تنص في مخططك على أيّهما تعني بدل افتراض أن قارئك على مذهبك.
حدودٌ صادقة
أكثر اللغات لا رمز ثنائي لها. فمن الست والثمانين وأربعمئة لا يحمله إلا مئةٌ وثلاثة وثمانون، والباقيةُ ثلاثمئة وثلاث لها ثلاثة أحرف وليس أقصر منها. فالسيبوانية، ويتكلمها أكثر من عشرين مليونًا، رمزها ceb وليس لها صورة في ISO 639-1. فعمودٌ من محرفين لا يسع أكثر لغات العالم، ومنتقي لغاتٍ مبنيٌّ على قائمة الحرفين يستبعد أكثرها في صمت.
وسطرٌ واحد في الملف ليس لغة. فالمدخل qaa-qtz مدًى يمثل خمسمئة وعشرين رمزًا محجوزة للاستعمال الخاص: لكل أحدٍ أن يستعملها داخليًّا للغةٍ لا يغطيها المعيار، ولن يُخصَّص منها شيءٌ أبدًا. والجدولُ يعرضه سطرًا واحدًا ويصفه، بدل الإيهام بأنه لغة أو إسقاطه في صمت.
والأسماء المترجمة من يونيكود CLDR، وليس فيه اسمٌ لكل مدخل. فالرموزُ الجامعة مثل «اللغات البانتوية» وكثيرٌ من اللغات القديمة والمصطنعة لا اسم لها في CLDR بأي لغة، فترجع تلك الأسطر إلى الاسم الإنجليزي من جهة التسجيل. ونحو تسعة عشر وأربعمئة من الست والثمانين وأربعمئة مسمّاةٌ في كل لغة، والرقمُ الدقيق يختلف قليلًا بينها، وهذه بعينها صورةُ النقص الحقيقي في البيانات، بخلاف بحثٍ فاشل.
وأخيرًا فهذا ISO 639-2 لا 639-3. فالمعيار الأكبر يغطي نحو سبعة آلاف لغة، أي كل ما وُثّق منها تقريبًا، وتتولاه على حدة منظمة SIL International. فإن أعوزتك لغةٌ هنا فهناك موضع البحث.
لماذا هي مجانية؟
لأنها جدولٌ وصندوق بحث. فالقائمة كلها في الصفحة التي حمّلتها بالفعل، والبحث يجري في متصفحك، ولا يخرج شيءٌ مما تكتبه.
فلا حساب ولا تسجيل ولا شيء محجوب. والمولّد الذي يبني هذا من قائمة مكتبة الكونغرس ومن يونيكود CLDR في المستودع إلى جوار الصفحة، ومعه ألفان وأحد عشر تحققًا تفحص الرموز والأزواج العشرين الملتبسة وخاصية BCP 47، ومنها الضوابط السالبة التي تمنع نجاح تلك الاختبارات لسببٍ خاطئ.