The World's largest open multilingual profanity & abuse dataset on Hugging Face — ~82k annotated entries across 715 languages and 459 countries of dialects, with severity, hate-speech flags, tone, generational slang, etymology, and rich cultural context.
Code -
github.com
Dataset -
huggingface.co
Website -
profanity-bench.vercel.app