Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

NaijaSenti: A Nigerian Twitter Sentiment Corpus for Multilingual Sentiment Analysis

Domaine:

natural language processing

Type de record:

paper
Sentiment analysis is one of the most widely studied applications in NLP, but most work focuses on languages with large amounts of data. We introduce the first large-scale human-annotated Twitter sentiment dataset for the four most widely spoken languages in Nigeria (Hausa, Igbo, Nigerian-Pidgin, and Yorùbá ) consisting of around 30,000 annotated tweets per language (and 14,000 for Nigerian-Pidgin), including a significant fraction of code-mixed tweets. We propose text collection, filtering, processing and labeling methods that enable us to create datasets for these low-resource languages. We evaluate a rangeof pre-trained models and transfer strategies on the dataset. We find that language-specific models and language-adaptivefine-tuning generally perform best. We release the datasets, trained models, sentiment lexicons, and code to incentivizeresearch on sentiment analysis in under-represented languages.

Visit

arxiv.orgwww.semanticscholar.org

Connected records

datasetmodeldataset

Tasks

sentiment analysistext classification

Languages

HausaIgboPidgin, NigerianYoruba

Licenses

https://github.com/hausanlp/NaijaSenti#license

Similaires

NaijaSenti: A Nigerian Twitter Sentiment Corpus for Multilingual Sentiment Analysis NaijaSenti: A Nigerian Twitter Sentiment Corpus for Multilingual Sentiment Analysis NaijaSenti: مجموعة معنويات تويتر نيجيرية لتحليل المعنويات متعدد اللغات NaijaSenti : un corpus de sentiments nigérian sur Twitter pour l'analyse des sentiments multilingues NaijaSenti: un corpus de sentimientos de Twitter nigeriano para el análisis de sentimientos multilingüesDetecting sentiments and combatting hate speech in Hausa, Igbo, Nigerian-Pidgin and Yorùbá - NaijaSenti: a Nigerian Corpus for Multilingual Sentiment Analysis

NaijaSenti: A Nigerian Twitter Sentiment Corpus for Multilingual Sentiment Analysis

NaijaSenti is an open-source sentiment and emotion corpora for four major Nigerian languages. This project was supported by lacuna-fund initiatives. Jump straight to one of the sections below, or just scroll down to find out more.

NaijaSenti: A Nigerian Twitter Sentiment Corpus for Multilingual Sentiment Analysis NaijaSenti: مجموعة معنويات تويتر نيجيرية لتحليل المعنويات متعدد اللغات NaijaSenti : un corpus de sentiments nigérian sur Twitter pour l'analyse des sentiments multilingues NaijaSenti: un corpus de sentimientos de Twitter nigeriano para el análisis de sentimientos multilingües

We introduce the first large-scale human-annotated Twitter sentiment dataset for the four most widel

Detecting sentiments and combatting hate speech in Hausa, Igbo, Nigerian-Pidgin and Yorùbá - NaijaSenti: a Nigerian Corpus for Multilingual Sentiment Analysis

The NaijaSenti dataset is the first large-scale human-annotated Twitter sentiment dataset for Hausa,