Gold Standards, Uneven Ground
Rethinking Evaluation for Low-Resource Language Technology
DOI:
https://doi.org/10.0000/meridian.demo.2026.002کلمات کلیدی:
low-resource languages, benchmarking, annotation qualityچکیده
Evaluation sets are frequently called gold standards even when annotation conditions, speaker coverage, and domain assumptions differ sharply across languages. This paper proposes a transparent reporting framework for low-resource evaluation and demonstrates how uncertainty-aware interpretation changes comparisons between systems.
دانلودها
چاپ شده
2026-06-18
شماره
نوع مقاله
مقالات