数据集:
Baybars/parla_text_corpus
语言:
许可:
计算机处理:
monolingual语言创建人:
various批注创建人:
no-annotation源数据集:
found大小:
100K<n<1M子任务:
language-modelingSpoken text corpus for Catalan. Derived and cleaned from three sources. OpenSubtitles, Tv3Parla and Festcat.