Korpuse të Arabisht
Baza të dhënash akademike që dokumentojnë Arabisht dhe dialektet e saj. Çdo kartë hap korpusin në një skedë të re.
- Korpus
UD Arabic PADT Treebank
Open release of the Prague Arabic Dependency Treebank — newswire Modern Standard Arabic, dependency-annotated (Charles University Prague / Universal Dependencies).
- Korpus
Tashkeela — Arabic Diacritization Corpus
75-million-word vocalized Arabic corpus from classical and modern sources, released for diacritization research (Zerrouki & Balla, Data in Brief 2017).
- Korpus
arabiCorpus
Searchable Arabic corpus with newspaper, modern literature, nonfiction, premodern, and Egyptian Colloquial sub-corpora (Brigham Young University).
Dialekte- Arabishtja egjiptiane
- Korpus
Tunisiya — Tunisian Arabic Corpus
One-million-word written corpus of Tunisian Arabic across folktales, blogs, newspapers, TV, and literature (Karen McNeil & Miled Faiza, Georgetown).
Dialekte- Arabishtja magrebiane
- Fjalor
Living Dictionary — Levantine Arabic
Community-built dictionary of Levantine Arabic; specific sub-variety (Syrian/Palestinian/Lebanese/Jordanian) is not declared on the project page (Living Tongues Institute for Endangered Languages).
Dialekte- Arabishtja levantine
- Fjalor
Living Dictionary — Moroccan Arabic (Darija)
Community-built dictionary of Moroccan Arabic (Darija) (Living Tongues Institute for Endangered Languages).
Dialekte- Arabishtja magrebiane