EXAONE-ExaDialogue-DPO-2.4B

This model is finetuned from beomi/EXAONE-3.5-2.4B-Instruct-Llamafied.

This model is a DPO-aligned version of lunar1020/EXAONE-ExaDialogue-2.4B.

Personal Practice Project Result for Junior Summer 2026

2026 1학기 개인 실습 결과물 게시용

2026 통영고 3학년

Downloads last month
443
Safetensors
Model size
2B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for lunar1020/EXAONE-ExaDialogue-DPO-2.4B

Finetuned
(1)
this model

Dataset used to train lunar1020/EXAONE-ExaDialogue-DPO-2.4B

Collection including lunar1020/EXAONE-ExaDialogue-DPO-2.4B