YAML Metadata Warning:empty or missing yaml metadata in repo card
Check out the documentation for more information.
!pip install transformers torch peft bitsandbytes datasets accelerate
์ฝ๋
import torch
from transformers import AutoTokenizer, AutoModelForCausalLM, pipeline, BitsAndBytesConfig
# --------------------------------------------------
# 1. ๋ชจ๋ธ ๊ฒฝ๋ก ๋ฐ ์ด๋ฆ ์ค์
# --------------------------------------------------
# (๋ชจ๋ธ 1) ํ์ธํ๋ ๋ฐ ์์ํ๋ ๋ชจ๋ธ
finetuning_model = "djc05142/cst_quantized_model_v4"
# --------------------------------------------------
# 2. ๊ฐ ๋ชจ๋ธ ๋ก๋
# --------------------------------------------------
# --- ๋ชจ๋ธ 1: ํ์ธํ๋ & ์์ํ ๋ชจ๋ธ ๋ก๋ ---
quantization_config = BitsAndBytesConfig(
load_in_4bit=True,
bnb_4bit_quant_type="nf4",
bnb_4bit_compute_dtype=torch.bfloat16,
bnb_4bit_use_double_quant=False,
)
quantized_model = AutoModelForCausalLM.from_pretrained(
finetuning_model,
quantization_config=quantization_config,
device_map="auto",
)
quantized_tokenizer = AutoTokenizer.from_pretrained(finetuning_model)
# --------------------------------------------------
# 3. ํ์ดํ๋ผ์ธ ์์ฑ
# --------------------------------------------------
quantized_pipe = pipeline("text-generation", model=quantized_model, tokenizer=quantized_tokenizer)
from transformers import AutoTokenizer
# --------------------------------------------------
# 4. ๋์ผํ ํ๋กฌํํธ๋ก ๊ฐ ๋ชจ๋ธ์ ์ถ๋ก ์์ฒญ ๋ฐ ๋น๊ต
# --------------------------------------------------
# ํ์ธํ๋ ๋ฐ์ดํฐ(๊ตฌ์ด์ฒด)์ ํน์ฑ์ด ์ ๋๋ฌ๋๋ ์ง๋ฌธ์ ์ ํ
tokenizer = AutoTokenizer.from_pretrained(finetuning_model)
if tokenizer.pad_token is None:
tokenizer.pad_token = tokenizer.eos_token
question = "๊น์น๋ณถ์๋ฐฅ ์ฌ๋ฃ๊ฐ ๋ญ์ผ?"
prompt = f"### ์ง๋ฌธ:{question}\n\n### ๋ต๋ณ:"
print("\n" + "="*60)
print(f"์ง๋ฌธ: {prompt.split('### ๋ต๋ณ:')[0].replace('### ์ง๋ฌธ: ', '').strip()}")
print("="*60 + "\n")
# ํ์ธํ๋ & ์์ํ ๋ชจ๋ธ ์ถ๋ก
print("1. ํ์ธํ๋ ๋ชจ๋ธ ๋ต๋ณ:")
quantized_result = quantized_pipe(
prompt,
temperature=0.7,
eos_token_id=tokenizer.eos_token_id,
return_full_text=False
)
print(quantized_result[0]['generated_text'])
print("\n" + "="*60)
- Downloads last month
- 5
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐ Ask for provider support