Σώματα κειμένων Αραβικά
Επιστημονικές βάσεις δεδομένων που τεκμηριώνουν τη γλώσσα Αραβικά και τις διαλέκτους της. Κάθε κάρτα ανοίγει το σώμα κειμένων σε νέα καρτέλα.
- Σώμα κειμένων
UD Arabic PADT Treebank
Open release of the Prague Arabic Dependency Treebank — newswire Modern Standard Arabic, dependency-annotated (Charles University Prague / Universal Dependencies).
- Σώμα κειμένων
Tashkeela — Arabic Diacritization Corpus
75-million-word vocalized Arabic corpus from classical and modern sources, released for diacritization research (Zerrouki & Balla, Data in Brief 2017).
- Σώμα κειμένων
arabiCorpus
Searchable Arabic corpus with newspaper, modern literature, nonfiction, premodern, and Egyptian Colloquial sub-corpora (Brigham Young University).
Διάλεκτοι- Αιγυπτιακά αραβικά
- Σώμα κειμένων
Tunisiya — Tunisian Arabic Corpus
One-million-word written corpus of Tunisian Arabic across folktales, blogs, newspapers, TV, and literature (Karen McNeil & Miled Faiza, Georgetown).
Διάλεκτοι- Μαγρεβινά αραβικά
- Λεξικό
Living Dictionary — Levantine Arabic
Community-built dictionary of Levantine Arabic; specific sub-variety (Syrian/Palestinian/Lebanese/Jordanian) is not declared on the project page (Living Tongues Institute for Endangered Languages).
Διάλεκτοι- Λεβαντινά αραβικά
- Λεξικό
Living Dictionary — Moroccan Arabic (Darija)
Community-built dictionary of Moroccan Arabic (Darija) (Living Tongues Institute for Endangered Languages).
Διάλεκτοι- Μαγρεβινά αραβικά