Study finds LLM hate-speech screening is less consistent in Urdu scripts
An arXiv preprint reports that five large language models changed harmful-content classifications across Urdu scripts and English translations, revealing a measurable “Missed-in-Urdu” safety gap.