OST-VQA: VQA dataset for On-Screen Text
VILQA: VQA dataset for visual perception (LREC 2026)
PLABA-EVAL: A Multi-Dimensional, In-Context Sentence Readability Dataset for Medical Text (TSAR 2026)
CTSEG: CEFR-based Targeted Syntactic Evaluation Dataset for Grammatical Error Correction (ACL 2025)
Fair_comparison_instructions: Dataset for a Fair Comparison without Translationese (NAACL 2025)
JMWE-parallel: Dataset of literal usage examples for Japanese multiword expressions (MWEs) (ACL SRW 2026)
JaFaithSum: A Japanese Faithfulness Evaluation Dataset for LLM Summarization (EACL SRW 2026)
JADOS-eval: 文書レベルの日本語平易化の評価データセット (LREC-COLING 2024)
acss-simmat: Analyzing Continuous Semantic Shifts with Diachronic Word Similarity Matrices (COLING 2025)
pruning_for_multilinguality: Pruning Multilingual Large Language Models for Multilingual Inferece (EMNLP 2024)