localmodels
/

OpenAssistant-LLaMA-30B-SFT-7-GPTQ

Text Generation

Inference Endpoints

text-generation-inference

Model card Files Files and versions

OpenAssistant-LLaMA-30B-SFT-7-GPTQ / README.md

ukim4's picture

Duplicate from localmodels/LLM

6a470d8 12 months ago

|

raw history blame

No virus

1.92 kB

	---
	duplicated_from: localmodels/LLM
	---
	# OpenAssistant LLaMA 30B SFT 7 GPTQ

	From: https://huggingface.co/OpenAssistant/oasst-sft-7-llama-30b-xor

	---

	\| Model \| Bits \| Group Size \| Act Order (desc_act) \| File Size \| ExLlama Compatible? \| Made With \| Description \|
	\| ------ \| ---- \| ---------- \| -------------------- \| --------- \| ------------------- \| --------- \| ----------- \|
	\| OpenAssistant-SFT-7-LLaMA-30B-GPTQ-4bit--1g.act.order \| 4 \| None \| True \| 16.94 GB \| True \| GPTQ-for-LLaMa \| Most compatible. Good inference speed in AutoGPTQ and GPTQ-for-LLaMa. \|

	---

	# OpenAssistant LLaMA 30B SFT 7

	### Configuration

	```
	llama-30b-sft-7:
	dtype: fp16
	log_dir: "llama_log_30b"
	learning_rate: 1e-5
	model_name: /home/ubuntu/Open-Assistant/model/model_training/.saved/llama-30b-super-pretrain/checkpoint-3500
	#model_name: OpenAssistant/llama-30b-super-pretrain
	output_dir: llama_model_30b
	deepspeed_config: configs/zero3_config_sft.json
	weight_decay: 0.0
	residual_dropout: 0.0
	max_length: 2048
	use_flash_attention: true
	warmup_steps: 20
	gradient_checkpointing: true
	gradient_accumulation_steps: 12
	per_device_train_batch_size: 2
	per_device_eval_batch_size: 3
	eval_steps: 101
	save_steps: 485
	num_train_epochs: 4
	save_total_limit: 3
	use_custom_sampler: true
	sort_by_length: false
	#save_strategy: steps
	save_strategy: epoch
	datasets:
	- oasst_export:
	lang: "bg,ca,cs,da,de,en,es,fr,hr,hu,it,nl,pl,pt,ro,ru,sl,sr,sv,uk"
	input_file_path: 2023-04-12_oasst_release_ready_synth.jsonl.gz
	val_split: 0.05
	- vicuna:
	val_split: 0.05
	max_val_set: 800
	fraction: 1.0
	- dolly15k:
	val_split: 0.05
	max_val_set: 300
	- grade_school_math_instructions:
	val_split: 0.05
	- code_alpaca:
	val_split: 0.05
	max_val_set: 250
	```

	- OASST dataset paper: https://arxiv.org/abs/2304.07327