DistilBERT Phishing Classifier โ€” Phishing Email Dataset

Fine-tuned distilbert-base-uncased for binary phishing/spam classification, trained on the Phishing Email Dataset dataset as part of an empirical study on adversarial robustness (homoglyph substitution vs. synonym replacement attacks).

  • Training: 3 epochs, batch size 32, AdamW, lr=2e-5
  • Baseline accuracy: see paper Table/Fig. 1
  • Part of: "Adversarial Robustness of NLP-Based Phishing Email Classifiers: A Multi-Dataset Empirical Study" (CJSJ 2026, Muktadir Arif)
Downloads last month
17
Safetensors
Model size
67M params
Tensor type
F32
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support