Σώματα κειμένων Κουρδικά
Επιστημονικές βάσεις δεδομένων που τεκμηριώνουν τη γλώσσα Κουρδικά και τις διαλέκτους της. Κάθε κάρτα ανοίγει το σώμα κειμένων σε νέα καρτέλα.
- Σώμα κειμένων
UD Northern Kurdish — Kurmanji Treebank
Kurmanji dependency treebank built from a 1944 Sherlock Holmes translation and Wikipedia sentences (Gökırmak & Tyers; Universal Dependencies).
Διάλεκτοι- Κουρμαντζί
- Σώμα κειμένων
AsoSoft Text Corpus
First large-scale Central Kurdish (Sorani) text corpus, 75M-token large version + 5M-token small version, with topic annotations (AsoSoft, published in Digital Scholarship in the Humanities).
Διάλεκτοι- Σοράνι
- Σώμα κειμένων
Pewan — Kurdish IR Test Collection
News-crawled corpus of 115k Sorani and 25k Kurmanji articles (2003–2012) plus IR query set and relevance judgements (Esmaili et al.; hosted by Sina Ahmadi).
Διάλεκτοι- Σοράνι
- Κουρμαντζί
- Σώμα κειμένων
Zaza-Gorani Corpus
News-text corpus covering Zazaki (4,855 articles / 1.6M tokens) and Gorani including Hawrami (428 articles / 195k tokens) (Sina Ahmadi).
Διάλεκτοι- Ζαζακί
- Χαουραμί
- Λεξικό
Living Dictionary — Central Kurdish (Sorani)
Community-built dictionary of Central Kurdish (Sorani), the variety spoken in Iraqi Kurdistan and western Iran (Living Tongues Institute for Endangered Languages).
Διάλεκτοι- Σοράνι