reduce-to-639-1
Version:
Quick and dirty tool to reduce language claims to two-letter iso-639-1 codes
867 lines (855 loc) • 18.7 kB
JavaScript
var reductions = {
"abkhazian" : "ab",
"аҧсуа бызшәа, аҧсшәа" : "ab",
"ab" : "ab",
"abk" : "ab",
"аҧсуа бызшәа" : "ab",
"аҧсшәа" : "ab",
"afar" : "aa",
"afaraf" : "aa",
"aa" : "aa",
"aar" : "aa",
"afrikaans" : "af",
"af" : "af",
"afr" : "af",
"akan" : "ak",
"ak" : "ak",
"aka" : "ak",
"aka + 2" : "ak",
"albanian" : "sq",
"shqip" : "sq",
"sq" : "sq",
"sqi" : "sq",
"alb" : "sq",
"sqi + 4" : "sq",
"amharic" : "am",
"አማርኛ" : "am",
"am" : "am",
"amh" : "am",
"arabic" : "ar",
"العربية" : "ar",
"ar" : "ar",
"ara" : "ar",
"ara + 30" : "ar",
"aragonese" : "an",
"aragonés" : "an",
"an" : "an",
"arg" : "an",
"armenian" : "hy",
"հայերեն" : "hy",
"hy" : "hy",
"hye" : "hy",
"arm" : "hy",
"assamese" : "as",
"অসমীয়া" : "as",
"as" : "as",
"asm" : "as",
"avaric" : "av",
"авар мацӏ, магӏарул мацӏ" : "av",
"av" : "av",
"ava" : "av",
"авар мацӏ" : "av",
"магӏарул мацӏ" : "av",
"avestan" : "ae",
"avesta" : "ae",
"ae" : "ae",
"ave" : "ae",
"aymara" : "ay",
"aymar aru" : "ay",
"ay" : "ay",
"aym" : "ay",
"aym + 2" : "ay",
"azerbaijani" : "az",
"azərbaycan dili" : "az",
"az" : "az",
"aze" : "az",
"aze + 2" : "az",
"bambara" : "bm",
"bamanankan" : "bm",
"bm" : "bm",
"bam" : "bm",
"bashkir" : "ba",
"башҡорт теле" : "ba",
"ba" : "ba",
"bak" : "ba",
"basque" : "eu",
"euskara, euskera" : "eu",
"eu" : "eu",
"eus" : "eu",
"baq" : "eu",
"euskara" : "eu",
"euskera" : "eu",
"belarusian" : "be",
"беларуская мова" : "be",
"be" : "be",
"bel" : "be",
"bengali" : "bn",
"বাংলা" : "bn",
"bn" : "bn",
"ben" : "bn",
"bihari languages" : "bh",
"भोजपुरी" : "bh",
"bh" : "bh",
"bih" : "bh",
"bislama" : "bi",
"bi" : "bi",
"bis" : "bi",
"bosnian" : "bs",
"bosanski jezik" : "bs",
"bs" : "bs",
"bos" : "bs",
"breton" : "br",
"brezhoneg" : "br",
"br" : "br",
"bre" : "br",
"bulgarian" : "bg",
"български език" : "bg",
"bg" : "bg",
"bul" : "bg",
"burmese" : "my",
"ဗမာစာ" : "my",
"my" : "my",
"mya" : "my",
"bur" : "my",
"catalan, valencian" : "ca",
"català, valencià" : "ca",
"ca" : "ca",
"cat" : "ca",
"català" : "ca",
"valencià" : "ca",
"chamorro" : "ch",
"chamoru" : "ch",
"ch" : "ch",
"cha" : "ch",
"chechen" : "ce",
"нохчийн мотт" : "ce",
"ce" : "ce",
"che" : "ce",
"chichewa, chewa, nyanja" : "ny",
"chicheŵa, chinyanja" : "ny",
"ny" : "ny",
"nya" : "ny",
"chicheŵa" : "ny",
"chinyanja" : "ny",
"chinese" : "zh",
"中文 (zhōngwén), 汉语, 漢語" : "zh",
"zh" : "zh",
"zho" : "zh",
"chi" : "zh",
"zho + 13" : "zh",
"中文 (zhōngwén)" : "zh",
"汉语" : "zh",
"漢語" : "zh",
"chuvash" : "cv",
"чӑваш чӗлхи" : "cv",
"cv" : "cv",
"chv" : "cv",
"cornish" : "kw",
"kernewek" : "kw",
"kw" : "kw",
"cor" : "kw",
"corsican" : "co",
"corsu, lingua corsa" : "co",
"co" : "co",
"cos" : "co",
"corsu" : "co",
"lingua corsa" : "co",
"cree" : "cr",
"ᓀᐦᐃᔭᐍᐏᐣ" : "cr",
"cr" : "cr",
"cre" : "cr",
"cre + 6" : "cr",
"croatian" : "hr",
"hrvatski jezik" : "hr",
"hr" : "hr",
"hrv" : "hr",
"czech" : "cs",
"čeština, český jazyk" : "cs",
"cs" : "cs",
"ces" : "cs",
"cze" : "cs",
"čeština" : "cs",
"český jazyk" : "cs",
"danish" : "da",
"dansk" : "da",
"da" : "da",
"dan" : "da",
"divehi, dhivehi, maldivian" : "dv",
"ދިވެހި" : "dv",
"dv" : "dv",
"div" : "dv",
"dutch, flemish" : "nl",
"nederlands, vlaams" : "nl",
"nl" : "nl",
"nld" : "nl",
"dut" : "nl",
"nederlands" : "nl",
"vlaams" : "nl",
"dzongkha" : "dz",
"རྫོང་ཁ" : "dz",
"dz" : "dz",
"dzo" : "dz",
"english" : "en",
"en" : "en",
"eng" : "en",
"esperanto" : "eo",
"eo" : "eo",
"epo" : "eo",
"estonian" : "et",
"eesti, eesti keel" : "et",
"et" : "et",
"est" : "et",
"est + 2" : "et",
"eesti" : "et",
"eesti keel" : "et",
"ewe" : "ee",
"eʋegbe" : "ee",
"ee" : "ee",
"faroese" : "fo",
"føroyskt" : "fo",
"fo" : "fo",
"fao" : "fo",
"fijian" : "fj",
"vosa vakaviti" : "fj",
"fj" : "fj",
"fij" : "fj",
"finnish" : "fi",
"suomi, suomen kieli" : "fi",
"fi" : "fi",
"fin" : "fi",
"suomi" : "fi",
"suomen kieli" : "fi",
"french" : "fr",
"français, langue française" : "fr",
"fr" : "fr",
"fra" : "fr",
"fre" : "fr",
"français" : "fr",
"langue française" : "fr",
"fulah" : "ff",
"fulfulde, pulaar, pular" : "ff",
"ff" : "ff",
"ful" : "ff",
"ful + 9" : "ff",
"fulfulde" : "ff",
"pulaar" : "ff",
"pular" : "ff",
"galician" : "gl",
"galego" : "gl",
"gl" : "gl",
"glg" : "gl",
"georgian" : "ka",
"ქართული" : "ka",
"ka" : "ka",
"kat" : "ka",
"geo" : "ka",
"german" : "de",
"deutsch" : "de",
"de" : "de",
"deu" : "de",
"ger" : "de",
"greek (modern)" : "el",
"ελληνικά" : "el",
"el" : "el",
"ell" : "el",
"gre" : "el",
"guaraní" : "gn",
"avañe'ẽ" : "gn",
"gn" : "gn",
"grn" : "gn",
"grn + 5" : "gn",
"gujarati" : "gu",
"ગુજરાતી" : "gu",
"gu" : "gu",
"guj" : "gu",
"haitian, haitian creole" : "ht",
"kreyòl ayisyen" : "ht",
"ht" : "ht",
"hat" : "ht",
"hausa" : "ha",
"(hausa) هَوُسَ" : "ha",
"ha" : "ha",
"hau" : "ha",
"hebrew (modern)" : "he",
"עברית" : "he",
"he" : "he",
"heb" : "he",
"herero" : "hz",
"otjiherero" : "hz",
"hz" : "hz",
"her" : "hz",
"hindi" : "hi",
"हिन्दी, हिंदी" : "hi",
"hi" : "hi",
"hin" : "hi",
"हिन्दी" : "hi",
"हिंदी" : "hi",
"hiri motu" : "ho",
"ho" : "ho",
"hmo" : "ho",
"hungarian" : "hu",
"magyar" : "hu",
"hu" : "hu",
"hun" : "hu",
"interlingua" : "ia",
"ia" : "ia",
"ina" : "ia",
"indonesian" : "id",
"bahasa indonesia" : "id",
"id" : "id",
"ind" : "id",
"interlingue" : "ie",
"originally called occidental; then interlingue after wwii" : "ie",
"ie" : "ie",
"ile" : "ie",
"irish" : "ga",
"gaeilge" : "ga",
"ga" : "ga",
"gle" : "ga",
"igbo" : "ig",
"asụsụ igbo" : "ig",
"ig" : "ig",
"ibo" : "ig",
"inupiaq" : "ik",
"iñupiaq, iñupiatun" : "ik",
"ik" : "ik",
"ipk" : "ik",
"ipk + 2" : "ik",
"iñupiaq" : "ik",
"iñupiatun" : "ik",
"ido" : "io",
"io" : "io",
"icelandic" : "is",
"íslenska" : "is",
"is" : "is",
"isl" : "is",
"ice" : "is",
"italian" : "it",
"italiano" : "it",
"it" : "it",
"ita" : "it",
"inuktitut" : "iu",
"ᐃᓄᒃᑎᑐᑦ" : "iu",
"iu" : "iu",
"iku" : "iu",
"iku + 2" : "iu",
"japanese" : "ja",
"日本語 (にほんご)" : "ja",
"ja" : "ja",
"jpn" : "ja",
"javanese" : "jv",
"ꦧꦱꦗꦮ, basa jawa" : "jv",
"jv" : "jv",
"jav" : "jv",
"ꦧꦱꦗꦮ" : "jv",
"basa jawa" : "jv",
"kalaallisut, greenlandic" : "kl",
"kalaallisut, kalaallit oqaasii" : "kl",
"kl" : "kl",
"kal" : "kl",
"kalaallisut" : "kl",
"kalaallit oqaasii" : "kl",
"kannada" : "kn",
"ಕನ್ನಡ" : "kn",
"kn" : "kn",
"kan" : "kn",
"kanuri" : "kr",
"kr" : "kr",
"kau" : "kr",
"kau + 3" : "kr",
"kashmiri" : "ks",
"कश्मीरी, كشميري" : "ks",
"ks" : "ks",
"kas" : "ks",
"कश्मीरी" : "ks",
"كشميري" : "ks",
"kazakh" : "kk",
"қазақ тілі" : "kk",
"kk" : "kk",
"kaz" : "kk",
"central khmer" : "km",
"ខ្មែរ, ខេមរភាសា, ភាសាខ្មែរ" : "km",
"km" : "km",
"khm" : "km",
"ខ្មែរ" : "km",
"ខេមរភាសា" : "km",
"ភាសាខ្មែរ" : "km",
"kikuyu, gikuyu" : "ki",
"gĩkũyũ" : "ki",
"ki" : "ki",
"kik" : "ki",
"kinyarwanda" : "rw",
"ikinyarwanda" : "rw",
"rw" : "rw",
"kin" : "rw",
"kirghiz, kyrgyz" : "ky",
"кыргызча, кыргыз тили" : "ky",
"ky" : "ky",
"kir" : "ky",
"кыргызча" : "ky",
"кыргыз тили" : "ky",
"komi" : "kv",
"коми кыв" : "kv",
"kv" : "kv",
"kom" : "kv",
"kom + 2" : "kv",
"kongo" : "kg",
"kikongo" : "kg",
"kg" : "kg",
"kon" : "kg",
"kon + 3" : "kg",
"korean" : "ko",
"한국어" : "ko",
"ko" : "ko",
"kor" : "ko",
"kurdish" : "ku",
"kurdî, كوردی" : "ku",
"ku" : "ku",
"kur" : "ku",
"kur + 3" : "ku",
"kurdî" : "ku",
"كوردی" : "ku",
"kuanyama, kwanyama" : "kj",
"kuanyama" : "kj",
"kj" : "kj",
"kua" : "kj",
"latin" : "la",
"latine, lingua latina" : "la",
"la" : "la",
"lat" : "la",
"latine" : "la",
"lingua latina" : "la",
"luxembourgish, letzeburgesch" : "lb",
"lëtzebuergesch" : "lb",
"lb" : "lb",
"ltz" : "lb",
"ganda" : "lg",
"luganda" : "lg",
"lg" : "lg",
"lug" : "lg",
"limburgan, limburger, limburgish" : "li",
"limburgs" : "li",
"li" : "li",
"lim" : "li",
"lingala" : "ln",
"lingála" : "ln",
"ln" : "ln",
"lin" : "ln",
"lao" : "lo",
"ພາສາລາວ" : "lo",
"lo" : "lo",
"lithuanian" : "lt",
"lietuvių kalba" : "lt",
"lt" : "lt",
"lit" : "lt",
"luba-katanga" : "lu",
"kiluba" : "lu",
"lu" : "lu",
"lub" : "lu",
"latvian" : "lv",
"latviešu valoda" : "lv",
"lv" : "lv",
"lav" : "lv",
"lav + 2" : "lv",
"manx" : "gv",
"gaelg, gailck" : "gv",
"gv" : "gv",
"glv" : "gv",
"gaelg" : "gv",
"gailck" : "gv",
"macedonian" : "mk",
"македонски јазик" : "mk",
"mk" : "mk",
"mkd" : "mk",
"mac" : "mk",
"malagasy" : "mg",
"fiteny malagasy" : "mg",
"mg" : "mg",
"mlg" : "mg",
"mlg + 10" : "mg",
"malay" : "ms",
"bahasa melayu, بهاس ملايو" : "ms",
"ms" : "ms",
"msa" : "ms",
"may" : "ms",
"msa + 13" : "ms",
"bahasa melayu" : "ms",
"بهاس ملايو" : "ms",
"malayalam" : "ml",
"മലയാളം" : "ml",
"ml" : "ml",
"mal" : "ml",
"maltese" : "mt",
"malti" : "mt",
"mt" : "mt",
"mlt" : "mt",
"maori" : "mi",
"te reo māori" : "mi",
"mi" : "mi",
"mri" : "mi",
"mao" : "mi",
"marathi" : "mr",
"मराठी" : "mr",
"mr" : "mr",
"mar" : "mr",
"marshallese" : "mh",
"kajin m̧ajeļ" : "mh",
"mh" : "mh",
"mah" : "mh",
"mongolian" : "mn",
"монгол хэл" : "mn",
"mn" : "mn",
"mon" : "mn",
"mon + 2" : "mn",
"nauru" : "na",
"dorerin naoero" : "na",
"na" : "na",
"nau" : "na",
"navajo, navaho" : "nv",
"diné bizaad" : "nv",
"nv" : "nv",
"nav" : "nv",
"north ndebele" : "nd",
"isindebele" : "nr",
"nd" : "nd",
"nde" : "nd",
"nepali" : "ne",
"नेपाली" : "ne",
"ne" : "ne",
"nep" : "ne",
"ndonga" : "ng",
"owambo" : "ng",
"ng" : "ng",
"ndo" : "ng",
"norwegian bokmål" : "nb",
"norsk bokmål" : "nb",
"nb" : "nb",
"nob" : "nb",
"norwegian nynorsk" : "nn",
"norsk nynorsk" : "nn",
"nn" : "nn",
"nno" : "nn",
"norwegian" : "no",
"norsk" : "no",
"no" : "no",
"nor" : "no",
"nor + 2" : "no",
"sichuan yi, nuosu" : "ii",
"ꆈꌠ꒿ nuosuhxop" : "ii",
"ii" : "ii",
"iii" : "ii",
"south ndebele" : "nr",
"nr" : "nr",
"nbl" : "nr",
"occitan" : "oc",
"occitan, lenga d'òc" : "oc",
"oc" : "oc",
"oci" : "oc",
"lenga d'òc" : "oc",
"ojibwa" : "oj",
"ᐊᓂᔑᓈᐯᒧᐎᓐ" : "oj",
"oj" : "oj",
"oji" : "oj",
"oji + 7" : "oj",
"church slavic, church slavonic, old church slavonic, old slavonic, old bulgarian" : "cu",
"ѩзыкъ словѣньскъ" : "cu",
"cu" : "cu",
"chu" : "cu",
"oromo" : "om",
"afaan oromoo" : "om",
"om" : "om",
"orm" : "om",
"orm + 4" : "om",
"oriya" : "or",
"ଓଡ଼ିଆ" : "or",
"or" : "or",
"ori" : "or",
"ossetian, ossetic" : "os",
"ирон æвзаг" : "os",
"os" : "os",
"oss" : "os",
"panjabi, punjabi" : "pa",
"ਪੰਜਾਬੀ" : "pa",
"pa" : "pa",
"pan" : "pa",
"pali" : "pi",
"पाऴि" : "pi",
"pi" : "pi",
"pli" : "pi",
"persian" : "fa",
"فارسی" : "fa",
"fa" : "fa",
"fas" : "fa",
"per" : "fa",
"fas + 2" : "fa",
"polish" : "pl",
"język polski, polszczyzna" : "pl",
"pl" : "pl",
"pol" : "pl",
"język polski" : "pl",
"polszczyzna" : "pl",
"pashto, pushto" : "ps",
"پښتو" : "ps",
"ps" : "ps",
"pus" : "ps",
"pus + 3" : "ps",
"portuguese" : "pt",
"português" : "pt",
"pt" : "pt",
"por" : "pt",
"quechua" : "qu",
"runa simi, kichwa" : "qu",
"qu" : "qu",
"que" : "qu",
"que + 44" : "qu",
"runa simi" : "qu",
"kichwa" : "qu",
"romansh" : "rm",
"rumantsch grischun" : "rm",
"rm" : "rm",
"roh" : "rm",
"rundi" : "rn",
"ikirundi" : "rn",
"rn" : "rn",
"run" : "rn",
"romanian, moldavian, moldovan" : "ro",
"română" : "ro",
"ro" : "ro",
"ron" : "ro",
"rum" : "ro",
"russian" : "ru",
"русский" : "ru",
"ru" : "ru",
"rus" : "ru",
"sanskrit" : "sa",
"संस्कृतम्" : "sa",
"sa" : "sa",
"san" : "sa",
"sardinian" : "sc",
"sardu" : "sc",
"sc" : "sc",
"srd" : "sc",
"srd + 4" : "sc",
"sindhi" : "sd",
"सिन्धी, سنڌي، سندھی" : "sd",
"sd" : "sd",
"snd" : "sd",
"सिन्धी" : "sd",
"سنڌي، سندھی" : "sd",
"northern sami" : "se",
"davvisámegiella" : "se",
"se" : "se",
"sme" : "se",
"samoan" : "sm",
"gagana fa'a samoa" : "sm",
"sm" : "sm",
"smo" : "sm",
"sango" : "sg",
"yângâ tî sängö" : "sg",
"sg" : "sg",
"sag" : "sg",
"serbian" : "sr",
"српски језик" : "sr",
"sr" : "sr",
"srp" : "sr",
"gaelic, scottish gaelic" : "gd",
"gàidhlig" : "gd",
"gd" : "gd",
"gla" : "gd",
"shona" : "sn",
"chishona" : "sn",
"sn" : "sn",
"sna" : "sn",
"sinhala, sinhalese" : "si",
"සිංහල" : "si",
"si" : "si",
"sin" : "si",
"slovak" : "sk",
"slovenčina, slovenský jazyk" : "sk",
"sk" : "sk",
"slk" : "sk",
"slo" : "sk",
"slovenčina" : "sk",
"slovenský jazyk" : "sk",
"slovenian" : "sl",
"slovenski jezik, slovenščina" : "sl",
"sl" : "sl",
"slv" : "sl",
"slovenski jezik" : "sl",
"slovenščina" : "sl",
"somali" : "so",
"soomaaliga, af soomaali" : "so",
"so" : "so",
"som" : "so",
"soomaaliga" : "so",
"af soomaali" : "so",
"southern sotho" : "st",
"sesotho" : "st",
"st" : "st",
"sot" : "st",
"spanish, castilian" : "es",
"español" : "es",
"es" : "es",
"spa" : "es",
"sundanese" : "su",
"basa sunda" : "su",
"su" : "su",
"sun" : "su",
"swahili" : "sw",
"kiswahili" : "sw",
"sw" : "sw",
"swa" : "sw",
"swa + 2" : "sw",
"swati" : "ss",
"siswati" : "ss",
"ss" : "ss",
"ssw" : "ss",
"swedish" : "sv",
"svenska" : "sv",
"sv" : "sv",
"swe" : "sv",
"tamil" : "ta",
"தமிழ்" : "ta",
"ta" : "ta",
"tam" : "ta",
"telugu" : "te",
"తెలుగు" : "te",
"te" : "te",
"tel" : "te",
"tajik" : "tg",
"тоҷикӣ, toçikī, تاجیکی" : "tg",
"tg" : "tg",
"tgk" : "tg",
"тоҷикӣ" : "tg",
"toçikī" : "tg",
"تاجیکی" : "tg",
"thai" : "th",
"ไทย" : "th",
"th" : "th",
"tha" : "th",
"tigrinya" : "ti",
"ትግርኛ" : "ti",
"ti" : "ti",
"tir" : "ti",
"tibetan" : "bo",
"བོད་ཡིག" : "bo",
"bo" : "bo",
"bod" : "bo",
"tib" : "bo",
"turkmen" : "tk",
"türkmen, түркмен" : "tk",
"tk" : "tk",
"tuk" : "tk",
"türkmen" : "tk",
"түркмен" : "tk",
"tagalog" : "tl",
"wikang tagalog" : "tl",
"tl" : "tl",
"tgl" : "tl",
"tswana" : "tn",
"setswana" : "tn",
"tn" : "tn",
"tsn" : "tn",
"tonga (tonga islands)" : "to",
"faka tonga" : "to",
"to" : "to",
"ton" : "to",
"turkish" : "tr",
"türkçe" : "tr",
"tr" : "tr",
"tur" : "tr",
"tsonga" : "ts",
"xitsonga" : "ts",
"ts" : "ts",
"tso" : "ts",
"tatar" : "tt",
"татар теле, tatar tele" : "tt",
"tt" : "tt",
"tat" : "tt",
"татар теле" : "tt",
"tatar tele" : "tt",
"twi" : "tw",
"tw" : "tw",
"tahitian" : "ty",
"reo tahiti" : "ty",
"ty" : "ty",
"tah" : "ty",
"uighur, uyghur" : "ug",
"ئۇيغۇرچە, uyghurche" : "ug",
"ug" : "ug",
"uig" : "ug",
"ئۇيغۇرچە" : "ug",
"uyghurche" : "ug",
"ukrainian" : "uk",
"українська" : "uk",
"uk" : "uk",
"ukr" : "uk",
"urdu" : "ur",
"اردو" : "ur",
"ur" : "ur",
"urd" : "ur",
"uzbek" : "uz",
"oʻzbek, ўзбек, أۇزبېك" : "uz",
"uz" : "uz",
"uzb" : "uz",
"uzb + 2" : "uz",
"oʻzbek" : "uz",
"ўзбек" : "uz",
"أۇزبېك" : "uz",
"venda" : "ve",
"tshivenḓa" : "ve",
"ve" : "ve",
"ven" : "ve",
"vietnamese" : "vi",
"tiếng việt" : "vi",
"vi" : "vi",
"vie" : "vi",
"volapük" : "vo",
"vo" : "vo",
"vol" : "vo",
"walloon" : "wa",
"walon" : "wa",
"wa" : "wa",
"wln" : "wa",
"welsh" : "cy",
"cymraeg" : "cy",
"cy" : "cy",
"cym" : "cy",
"wel" : "cy",
"wolof" : "wo",
"wollof" : "wo",
"wo" : "wo",
"wol" : "wo",
"western frisian" : "fy",
"frysk" : "fy",
"fy" : "fy",
"fry" : "fy",
"xhosa" : "xh",
"isixhosa" : "xh",
"xh" : "xh",
"xho" : "xh",
"yiddish" : "yi",
"ייִדיש" : "yi",
"yi" : "yi",
"yid" : "yi",
"yid + 2" : "yi",
"yoruba" : "yo",
"yorùbá" : "yo",
"yo" : "yo",
"yor" : "yo",
"zhuang, chuang" : "za",
"saɯ cueŋƅ, saw cuengh" : "za",
"za" : "za",
"zha" : "za",
"zha + 16" : "za",
"saɯ cueŋƅ" : "za",
"saw cuengh" : "za",
"zulu" : "zu",
"isizulu" : "zu",
"zu" : "zu",
"zul" : "zu"
};
function reduce(from) {
return reductions[from.toLowerCase()];
}
export { reduce, reductions };