Hadhari (حذارِ) - Arabic Spam Detection
Hadhari is a machine learning model designed to detect spam messages in Arabic text, targeting unsolicited advertisements and fabricated medical excuses.
Model Details
- Algorithm: Linear Support Vector Classification (
LinearSVC) - Feature Extraction: TF-IDF Vectorization (
max_features=2000,ngram_range=(1,3))
Performance Metrics
- Overall Accuracy: 97.0%
- Spam Precision: 99.0%
Usage
Live API endpoint and documentation available at: Hadhari API Space