我正在尝试查找Fasttext的LID工具支持的语言名称,给定这些语言代码列表(此处):
我试图将ISO代码映射到每种语言,但似乎非标准化,可以使用ISO-639-1或ISO-639-3。是否有人有这些代码的语言名称列表,或者知道如何找到它们?
维基百科的列表也没有涵盖所有内容,因此手动映射也没有帮助。
更新:在GitHub上开了一个问题。
af als am an ar arz as ast av az azb ba bar bcl be bg bh bn bo bpy br bs bxr ca cbk ce ceb ckb co cs cv cy da de diq dsb dty dv el eml en eo es et eu fa fi fr frr fy ga gd gl gn gom gu gv he hi hif hr hsb ht hu hy ia id ie ilo io is it ja jbo jv ka kk km kn ko krc ku kv kw ky la lb lez li lmo lo lrc lt lv mai mg mhr min mk ml mn mr mrj ms mt mwl my myv mzn nah nap nds ne new nl nn no oc or os pa pam pfl pl pms pnb ps pt qu rm ro ru rue sa sah sc scn sco sd sh si sk sl so sq sr su sv sw ta te tg th tk tl tr tt tyv ug uk ur uz vec vep vi vls vo wa war wuu xal xmf yi yo yue zh
我试图将ISO代码映射到每种语言,但似乎非标准化,可以使用ISO-639-1或ISO-639-3。是否有人有这些代码的语言名称列表,或者知道如何找到它们?
维基百科的列表也没有涵盖所有内容,因此手动映射也没有帮助。
更新:在GitHub上开了一个问题。
als
,azb
。 - furas.csv
)。 - furas