UNPKG

reduce-to-639-1

Version:

Quick and dirty tool to reduce language claims to two-letter iso-639-1 codes

867 lines (855 loc) 18.7 kB
var reductions = { "abkhazian" : "ab", "аҧсуа бызшәа, аҧсшәа" : "ab", "ab" : "ab", "abk" : "ab", "аҧсуа бызшәа" : "ab", "аҧсшәа" : "ab", "afar" : "aa", "afaraf" : "aa", "aa" : "aa", "aar" : "aa", "afrikaans" : "af", "af" : "af", "afr" : "af", "akan" : "ak", "ak" : "ak", "aka" : "ak", "aka + 2" : "ak", "albanian" : "sq", "shqip" : "sq", "sq" : "sq", "sqi" : "sq", "alb" : "sq", "sqi + 4" : "sq", "amharic" : "am", "አማርኛ" : "am", "am" : "am", "amh" : "am", "arabic" : "ar", "العربية" : "ar", "ar" : "ar", "ara" : "ar", "ara + 30" : "ar", "aragonese" : "an", "aragonés" : "an", "an" : "an", "arg" : "an", "armenian" : "hy", "հայերեն" : "hy", "hy" : "hy", "hye" : "hy", "arm" : "hy", "assamese" : "as", "অসমীয়া" : "as", "as" : "as", "asm" : "as", "avaric" : "av", "авар мацӏ, магӏарул мацӏ" : "av", "av" : "av", "ava" : "av", "авар мацӏ" : "av", "магӏарул мацӏ" : "av", "avestan" : "ae", "avesta" : "ae", "ae" : "ae", "ave" : "ae", "aymara" : "ay", "aymar aru" : "ay", "ay" : "ay", "aym" : "ay", "aym + 2" : "ay", "azerbaijani" : "az", "azərbaycan dili" : "az", "az" : "az", "aze" : "az", "aze + 2" : "az", "bambara" : "bm", "bamanankan" : "bm", "bm" : "bm", "bam" : "bm", "bashkir" : "ba", "башҡорт теле" : "ba", "ba" : "ba", "bak" : "ba", "basque" : "eu", "euskara, euskera" : "eu", "eu" : "eu", "eus" : "eu", "baq" : "eu", "euskara" : "eu", "euskera" : "eu", "belarusian" : "be", "беларуская мова" : "be", "be" : "be", "bel" : "be", "bengali" : "bn", "বাংলা" : "bn", "bn" : "bn", "ben" : "bn", "bihari languages" : "bh", "भोजपुरी" : "bh", "bh" : "bh", "bih" : "bh", "bislama" : "bi", "bi" : "bi", "bis" : "bi", "bosnian" : "bs", "bosanski jezik" : "bs", "bs" : "bs", "bos" : "bs", "breton" : "br", "brezhoneg" : "br", "br" : "br", "bre" : "br", "bulgarian" : "bg", "български език" : "bg", "bg" : "bg", "bul" : "bg", "burmese" : "my", "ဗမာစာ" : "my", "my" : "my", "mya" : "my", "bur" : "my", "catalan, valencian" : "ca", "català, valencià" : "ca", "ca" : "ca", "cat" : "ca", "català" : "ca", "valencià" : "ca", "chamorro" : "ch", "chamoru" : "ch", "ch" : "ch", "cha" : "ch", "chechen" : "ce", "нохчийн мотт" : "ce", "ce" : "ce", "che" : "ce", "chichewa, chewa, nyanja" : "ny", "chicheŵa, chinyanja" : "ny", "ny" : "ny", "nya" : "ny", "chicheŵa" : "ny", "chinyanja" : "ny", "chinese" : "zh", "中文 (zhōngwén), 汉语, 漢語" : "zh", "zh" : "zh", "zho" : "zh", "chi" : "zh", "zho + 13" : "zh", "中文 (zhōngwén)" : "zh", "汉语" : "zh", "漢語" : "zh", "chuvash" : "cv", "чӑваш чӗлхи" : "cv", "cv" : "cv", "chv" : "cv", "cornish" : "kw", "kernewek" : "kw", "kw" : "kw", "cor" : "kw", "corsican" : "co", "corsu, lingua corsa" : "co", "co" : "co", "cos" : "co", "corsu" : "co", "lingua corsa" : "co", "cree" : "cr", "ᓀᐦᐃᔭᐍᐏᐣ" : "cr", "cr" : "cr", "cre" : "cr", "cre + 6" : "cr", "croatian" : "hr", "hrvatski jezik" : "hr", "hr" : "hr", "hrv" : "hr", "czech" : "cs", "čeština, český jazyk" : "cs", "cs" : "cs", "ces" : "cs", "cze" : "cs", "čeština" : "cs", "český jazyk" : "cs", "danish" : "da", "dansk" : "da", "da" : "da", "dan" : "da", "divehi, dhivehi, maldivian" : "dv", "ދިވެހި" : "dv", "dv" : "dv", "div" : "dv", "dutch, flemish" : "nl", "nederlands, vlaams" : "nl", "nl" : "nl", "nld" : "nl", "dut" : "nl", "nederlands" : "nl", "vlaams" : "nl", "dzongkha" : "dz", "རྫོང་ཁ" : "dz", "dz" : "dz", "dzo" : "dz", "english" : "en", "en" : "en", "eng" : "en", "esperanto" : "eo", "eo" : "eo", "epo" : "eo", "estonian" : "et", "eesti, eesti keel" : "et", "et" : "et", "est" : "et", "est + 2" : "et", "eesti" : "et", "eesti keel" : "et", "ewe" : "ee", "eʋegbe" : "ee", "ee" : "ee", "faroese" : "fo", "føroyskt" : "fo", "fo" : "fo", "fao" : "fo", "fijian" : "fj", "vosa vakaviti" : "fj", "fj" : "fj", "fij" : "fj", "finnish" : "fi", "suomi, suomen kieli" : "fi", "fi" : "fi", "fin" : "fi", "suomi" : "fi", "suomen kieli" : "fi", "french" : "fr", "français, langue française" : "fr", "fr" : "fr", "fra" : "fr", "fre" : "fr", "français" : "fr", "langue française" : "fr", "fulah" : "ff", "fulfulde, pulaar, pular" : "ff", "ff" : "ff", "ful" : "ff", "ful + 9" : "ff", "fulfulde" : "ff", "pulaar" : "ff", "pular" : "ff", "galician" : "gl", "galego" : "gl", "gl" : "gl", "glg" : "gl", "georgian" : "ka", "ქართული" : "ka", "ka" : "ka", "kat" : "ka", "geo" : "ka", "german" : "de", "deutsch" : "de", "de" : "de", "deu" : "de", "ger" : "de", "greek (modern)" : "el", "ελληνικά" : "el", "el" : "el", "ell" : "el", "gre" : "el", "guaraní" : "gn", "avañe'ẽ" : "gn", "gn" : "gn", "grn" : "gn", "grn + 5" : "gn", "gujarati" : "gu", "ગુજરાતી" : "gu", "gu" : "gu", "guj" : "gu", "haitian, haitian creole" : "ht", "kreyòl ayisyen" : "ht", "ht" : "ht", "hat" : "ht", "hausa" : "ha", "(hausa) هَوُسَ" : "ha", "ha" : "ha", "hau" : "ha", "hebrew (modern)" : "he", "עברית" : "he", "he" : "he", "heb" : "he", "herero" : "hz", "otjiherero" : "hz", "hz" : "hz", "her" : "hz", "hindi" : "hi", "हिन्दी, हिंदी" : "hi", "hi" : "hi", "hin" : "hi", "हिन्दी" : "hi", "हिंदी" : "hi", "hiri motu" : "ho", "ho" : "ho", "hmo" : "ho", "hungarian" : "hu", "magyar" : "hu", "hu" : "hu", "hun" : "hu", "interlingua" : "ia", "ia" : "ia", "ina" : "ia", "indonesian" : "id", "bahasa indonesia" : "id", "id" : "id", "ind" : "id", "interlingue" : "ie", "originally called occidental; then interlingue after wwii" : "ie", "ie" : "ie", "ile" : "ie", "irish" : "ga", "gaeilge" : "ga", "ga" : "ga", "gle" : "ga", "igbo" : "ig", "asụsụ igbo" : "ig", "ig" : "ig", "ibo" : "ig", "inupiaq" : "ik", "iñupiaq, iñupiatun" : "ik", "ik" : "ik", "ipk" : "ik", "ipk + 2" : "ik", "iñupiaq" : "ik", "iñupiatun" : "ik", "ido" : "io", "io" : "io", "icelandic" : "is", "íslenska" : "is", "is" : "is", "isl" : "is", "ice" : "is", "italian" : "it", "italiano" : "it", "it" : "it", "ita" : "it", "inuktitut" : "iu", "ᐃᓄᒃᑎᑐᑦ" : "iu", "iu" : "iu", "iku" : "iu", "iku + 2" : "iu", "japanese" : "ja", "日本語 (にほんご)" : "ja", "ja" : "ja", "jpn" : "ja", "javanese" : "jv", "ꦧꦱꦗꦮ, basa jawa" : "jv", "jv" : "jv", "jav" : "jv", "ꦧꦱꦗꦮ" : "jv", "basa jawa" : "jv", "kalaallisut, greenlandic" : "kl", "kalaallisut, kalaallit oqaasii" : "kl", "kl" : "kl", "kal" : "kl", "kalaallisut" : "kl", "kalaallit oqaasii" : "kl", "kannada" : "kn", "ಕನ್ನಡ" : "kn", "kn" : "kn", "kan" : "kn", "kanuri" : "kr", "kr" : "kr", "kau" : "kr", "kau + 3" : "kr", "kashmiri" : "ks", "कश्मीरी, كشميري‎" : "ks", "ks" : "ks", "kas" : "ks", "कश्मीरी" : "ks", "كشميري‎" : "ks", "kazakh" : "kk", "қазақ тілі" : "kk", "kk" : "kk", "kaz" : "kk", "central khmer" : "km", "ខ្មែរ, ខេមរភាសា, ភាសាខ្មែរ" : "km", "km" : "km", "khm" : "km", "ខ្មែរ" : "km", "ខេមរភាសា" : "km", "ភាសាខ្មែរ" : "km", "kikuyu, gikuyu" : "ki", "gĩkũyũ" : "ki", "ki" : "ki", "kik" : "ki", "kinyarwanda" : "rw", "ikinyarwanda" : "rw", "rw" : "rw", "kin" : "rw", "kirghiz, kyrgyz" : "ky", "кыргызча, кыргыз тили" : "ky", "ky" : "ky", "kir" : "ky", "кыргызча" : "ky", "кыргыз тили" : "ky", "komi" : "kv", "коми кыв" : "kv", "kv" : "kv", "kom" : "kv", "kom + 2" : "kv", "kongo" : "kg", "kikongo" : "kg", "kg" : "kg", "kon" : "kg", "kon + 3" : "kg", "korean" : "ko", "한국어" : "ko", "ko" : "ko", "kor" : "ko", "kurdish" : "ku", "kurdî, كوردی‎" : "ku", "ku" : "ku", "kur" : "ku", "kur + 3" : "ku", "kurdî" : "ku", "كوردی‎" : "ku", "kuanyama, kwanyama" : "kj", "kuanyama" : "kj", "kj" : "kj", "kua" : "kj", "latin" : "la", "latine, lingua latina" : "la", "la" : "la", "lat" : "la", "latine" : "la", "lingua latina" : "la", "luxembourgish, letzeburgesch" : "lb", "lëtzebuergesch" : "lb", "lb" : "lb", "ltz" : "lb", "ganda" : "lg", "luganda" : "lg", "lg" : "lg", "lug" : "lg", "limburgan, limburger, limburgish" : "li", "limburgs" : "li", "li" : "li", "lim" : "li", "lingala" : "ln", "lingála" : "ln", "ln" : "ln", "lin" : "ln", "lao" : "lo", "ພາສາລາວ" : "lo", "lo" : "lo", "lithuanian" : "lt", "lietuvių kalba" : "lt", "lt" : "lt", "lit" : "lt", "luba-katanga" : "lu", "kiluba" : "lu", "lu" : "lu", "lub" : "lu", "latvian" : "lv", "latviešu valoda" : "lv", "lv" : "lv", "lav" : "lv", "lav + 2" : "lv", "manx" : "gv", "gaelg, gailck" : "gv", "gv" : "gv", "glv" : "gv", "gaelg" : "gv", "gailck" : "gv", "macedonian" : "mk", "македонски јазик" : "mk", "mk" : "mk", "mkd" : "mk", "mac" : "mk", "malagasy" : "mg", "fiteny malagasy" : "mg", "mg" : "mg", "mlg" : "mg", "mlg + 10" : "mg", "malay" : "ms", "bahasa melayu, بهاس ملايو‎" : "ms", "ms" : "ms", "msa" : "ms", "may" : "ms", "msa + 13" : "ms", "bahasa melayu" : "ms", "بهاس ملايو‎" : "ms", "malayalam" : "ml", "മലയാളം" : "ml", "ml" : "ml", "mal" : "ml", "maltese" : "mt", "malti" : "mt", "mt" : "mt", "mlt" : "mt", "maori" : "mi", "te reo māori" : "mi", "mi" : "mi", "mri" : "mi", "mao" : "mi", "marathi" : "mr", "मराठी" : "mr", "mr" : "mr", "mar" : "mr", "marshallese" : "mh", "kajin m̧ajeļ" : "mh", "mh" : "mh", "mah" : "mh", "mongolian" : "mn", "монгол хэл" : "mn", "mn" : "mn", "mon" : "mn", "mon + 2" : "mn", "nauru" : "na", "dorerin naoero" : "na", "na" : "na", "nau" : "na", "navajo, navaho" : "nv", "diné bizaad" : "nv", "nv" : "nv", "nav" : "nv", "north ndebele" : "nd", "isindebele" : "nr", "nd" : "nd", "nde" : "nd", "nepali" : "ne", "नेपाली" : "ne", "ne" : "ne", "nep" : "ne", "ndonga" : "ng", "owambo" : "ng", "ng" : "ng", "ndo" : "ng", "norwegian bokmål" : "nb", "norsk bokmål" : "nb", "nb" : "nb", "nob" : "nb", "norwegian nynorsk" : "nn", "norsk nynorsk" : "nn", "nn" : "nn", "nno" : "nn", "norwegian" : "no", "norsk" : "no", "no" : "no", "nor" : "no", "nor + 2" : "no", "sichuan yi, nuosu" : "ii", "ꆈꌠ꒿ nuosuhxop" : "ii", "ii" : "ii", "iii" : "ii", "south ndebele" : "nr", "nr" : "nr", "nbl" : "nr", "occitan" : "oc", "occitan, lenga d'òc" : "oc", "oc" : "oc", "oci" : "oc", "lenga d'òc" : "oc", "ojibwa" : "oj", "ᐊᓂᔑᓈᐯᒧᐎᓐ" : "oj", "oj" : "oj", "oji" : "oj", "oji + 7" : "oj", "church slavic, church slavonic, old church slavonic, old slavonic, old bulgarian" : "cu", "ѩзыкъ словѣньскъ" : "cu", "cu" : "cu", "chu" : "cu", "oromo" : "om", "afaan oromoo" : "om", "om" : "om", "orm" : "om", "orm + 4" : "om", "oriya" : "or", "ଓଡ଼ିଆ" : "or", "or" : "or", "ori" : "or", "ossetian, ossetic" : "os", "ирон æвзаг" : "os", "os" : "os", "oss" : "os", "panjabi, punjabi" : "pa", "ਪੰਜਾਬੀ" : "pa", "pa" : "pa", "pan" : "pa", "pali" : "pi", "पाऴि" : "pi", "pi" : "pi", "pli" : "pi", "persian" : "fa", "فارسی" : "fa", "fa" : "fa", "fas" : "fa", "per" : "fa", "fas + 2" : "fa", "polish" : "pl", "język polski, polszczyzna" : "pl", "pl" : "pl", "pol" : "pl", "język polski" : "pl", "polszczyzna" : "pl", "pashto, pushto" : "ps", "پښتو" : "ps", "ps" : "ps", "pus" : "ps", "pus + 3" : "ps", "portuguese" : "pt", "português" : "pt", "pt" : "pt", "por" : "pt", "quechua" : "qu", "runa simi, kichwa" : "qu", "qu" : "qu", "que" : "qu", "que + 44" : "qu", "runa simi" : "qu", "kichwa" : "qu", "romansh" : "rm", "rumantsch grischun" : "rm", "rm" : "rm", "roh" : "rm", "rundi" : "rn", "ikirundi" : "rn", "rn" : "rn", "run" : "rn", "romanian, moldavian, moldovan" : "ro", "română" : "ro", "ro" : "ro", "ron" : "ro", "rum" : "ro", "russian" : "ru", "русский" : "ru", "ru" : "ru", "rus" : "ru", "sanskrit" : "sa", "संस्कृतम्" : "sa", "sa" : "sa", "san" : "sa", "sardinian" : "sc", "sardu" : "sc", "sc" : "sc", "srd" : "sc", "srd + 4" : "sc", "sindhi" : "sd", "सिन्धी, سنڌي، سندھی‎" : "sd", "sd" : "sd", "snd" : "sd", "सिन्धी" : "sd", "سنڌي، سندھی‎" : "sd", "northern sami" : "se", "davvisámegiella" : "se", "se" : "se", "sme" : "se", "samoan" : "sm", "gagana fa'a samoa" : "sm", "sm" : "sm", "smo" : "sm", "sango" : "sg", "yângâ tî sängö" : "sg", "sg" : "sg", "sag" : "sg", "serbian" : "sr", "српски језик" : "sr", "sr" : "sr", "srp" : "sr", "gaelic, scottish gaelic" : "gd", "gàidhlig" : "gd", "gd" : "gd", "gla" : "gd", "shona" : "sn", "chishona" : "sn", "sn" : "sn", "sna" : "sn", "sinhala, sinhalese" : "si", "සිංහල" : "si", "si" : "si", "sin" : "si", "slovak" : "sk", "slovenčina, slovenský jazyk" : "sk", "sk" : "sk", "slk" : "sk", "slo" : "sk", "slovenčina" : "sk", "slovenský jazyk" : "sk", "slovenian" : "sl", "slovenski jezik, slovenščina" : "sl", "sl" : "sl", "slv" : "sl", "slovenski jezik" : "sl", "slovenščina" : "sl", "somali" : "so", "soomaaliga, af soomaali" : "so", "so" : "so", "som" : "so", "soomaaliga" : "so", "af soomaali" : "so", "southern sotho" : "st", "sesotho" : "st", "st" : "st", "sot" : "st", "spanish, castilian" : "es", "español" : "es", "es" : "es", "spa" : "es", "sundanese" : "su", "basa sunda" : "su", "su" : "su", "sun" : "su", "swahili" : "sw", "kiswahili" : "sw", "sw" : "sw", "swa" : "sw", "swa + 2" : "sw", "swati" : "ss", "siswati" : "ss", "ss" : "ss", "ssw" : "ss", "swedish" : "sv", "svenska" : "sv", "sv" : "sv", "swe" : "sv", "tamil" : "ta", "தமிழ்" : "ta", "ta" : "ta", "tam" : "ta", "telugu" : "te", "తెలుగు" : "te", "te" : "te", "tel" : "te", "tajik" : "tg", "тоҷикӣ, toçikī, تاجیکی‎" : "tg", "tg" : "tg", "tgk" : "tg", "тоҷикӣ" : "tg", "toçikī" : "tg", "تاجیکی‎" : "tg", "thai" : "th", "ไทย" : "th", "th" : "th", "tha" : "th", "tigrinya" : "ti", "ትግርኛ" : "ti", "ti" : "ti", "tir" : "ti", "tibetan" : "bo", "བོད་ཡིག" : "bo", "bo" : "bo", "bod" : "bo", "tib" : "bo", "turkmen" : "tk", "türkmen, түркмен" : "tk", "tk" : "tk", "tuk" : "tk", "türkmen" : "tk", "түркмен" : "tk", "tagalog" : "tl", "wikang tagalog" : "tl", "tl" : "tl", "tgl" : "tl", "tswana" : "tn", "setswana" : "tn", "tn" : "tn", "tsn" : "tn", "tonga (tonga islands)" : "to", "faka tonga" : "to", "to" : "to", "ton" : "to", "turkish" : "tr", "türkçe" : "tr", "tr" : "tr", "tur" : "tr", "tsonga" : "ts", "xitsonga" : "ts", "ts" : "ts", "tso" : "ts", "tatar" : "tt", "татар теле, tatar tele" : "tt", "tt" : "tt", "tat" : "tt", "татар теле" : "tt", "tatar tele" : "tt", "twi" : "tw", "tw" : "tw", "tahitian" : "ty", "reo tahiti" : "ty", "ty" : "ty", "tah" : "ty", "uighur, uyghur" : "ug", "ئۇيغۇرچە‎, uyghurche" : "ug", "ug" : "ug", "uig" : "ug", "ئۇيغۇرچە‎" : "ug", "uyghurche" : "ug", "ukrainian" : "uk", "українська" : "uk", "uk" : "uk", "ukr" : "uk", "urdu" : "ur", "اردو" : "ur", "ur" : "ur", "urd" : "ur", "uzbek" : "uz", "oʻzbek, ўзбек, أۇزبېك‎" : "uz", "uz" : "uz", "uzb" : "uz", "uzb + 2" : "uz", "oʻzbek" : "uz", "ўзбек" : "uz", "أۇزبېك‎" : "uz", "venda" : "ve", "tshivenḓa" : "ve", "ve" : "ve", "ven" : "ve", "vietnamese" : "vi", "tiếng việt" : "vi", "vi" : "vi", "vie" : "vi", "volapük" : "vo", "vo" : "vo", "vol" : "vo", "walloon" : "wa", "walon" : "wa", "wa" : "wa", "wln" : "wa", "welsh" : "cy", "cymraeg" : "cy", "cy" : "cy", "cym" : "cy", "wel" : "cy", "wolof" : "wo", "wollof" : "wo", "wo" : "wo", "wol" : "wo", "western frisian" : "fy", "frysk" : "fy", "fy" : "fy", "fry" : "fy", "xhosa" : "xh", "isixhosa" : "xh", "xh" : "xh", "xho" : "xh", "yiddish" : "yi", "ייִדיש" : "yi", "yi" : "yi", "yid" : "yi", "yid + 2" : "yi", "yoruba" : "yo", "yorùbá" : "yo", "yo" : "yo", "yor" : "yo", "zhuang, chuang" : "za", "saɯ cueŋƅ, saw cuengh" : "za", "za" : "za", "zha" : "za", "zha + 16" : "za", "saɯ cueŋƅ" : "za", "saw cuengh" : "za", "zulu" : "zu", "isizulu" : "zu", "zu" : "zu", "zul" : "zu" }; function reduce(from) { return reductions[from.toLowerCase()]; } export { reduce, reductions };