3 papers
cs.CL2026
PerCoR: Evaluating Commonsense Reasoning in Persian via Multiple-Choice Sentence Completion
Morteza Alikhani, Mohammadtaha Bagherifard, Erfan Zinvandi +1
We introduced PerCoR (Persian Commonsense Reasoning), the first large-scale Persian benchmark for commonsense reasoning. PerCoR contains 106K multiple-choice sentence-completion pr…
cs.CL2025
Hakim: Farsi Text Embedding Model
Mehran Sarmadi, Morteza Alikhani, Erfan Zinvandi +1
Recent advancements in text embedding have significantly improved natural language understanding across many languages, yet Persian remains notably underrepresented in large-scale…
cs.CL2025
FaMTEB: Massive Text Embedding Benchmark in Persian Language
Erfan Zinvandi, Morteza Alikhani, Mehran Sarmadi +4
In this paper, we introduce a comprehensive benchmark for Persian (Farsi) text embeddings, built upon the Massive Text Embedding Benchmark (MTEB). Our benchmark includes 63 dataset…