YAML Metadata Warning:empty or missing yaml metadata in repo card

Check out the documentation for more information.

!pip install transformers torch peft bitsandbytes datasets accelerate

์ฝ”๋“œ

import torch
from transformers import AutoTokenizer, AutoModelForCausalLM, pipeline, BitsAndBytesConfig

# --------------------------------------------------
# 1. ๋ชจ๋ธ ๊ฒฝ๋กœ ๋ฐ ์ด๋ฆ„ ์„ค์ •
# --------------------------------------------------
# (๋ชจ๋ธ 1) ํŒŒ์ธํŠœ๋‹ ๋ฐ ์–‘์žํ™”๋œ ๋ชจ๋ธ
finetuning_model = "djc05142/cst_quantized_model_v4"
# --------------------------------------------------
# 2. ๊ฐ ๋ชจ๋ธ ๋กœ๋“œ
# --------------------------------------------------

# --- ๋ชจ๋ธ 1: ํŒŒ์ธํŠœ๋‹ & ์–‘์žํ™” ๋ชจ๋ธ ๋กœ๋“œ ---
quantization_config = BitsAndBytesConfig(
    load_in_4bit=True,
    bnb_4bit_quant_type="nf4",
    bnb_4bit_compute_dtype=torch.bfloat16,
    bnb_4bit_use_double_quant=False,
 )

quantized_model = AutoModelForCausalLM.from_pretrained(
    finetuning_model,
    quantization_config=quantization_config,
    device_map="auto",
)
quantized_tokenizer = AutoTokenizer.from_pretrained(finetuning_model)

# --------------------------------------------------
# 3. ํŒŒ์ดํ”„๋ผ์ธ ์ƒ์„ฑ
# --------------------------------------------------
quantized_pipe = pipeline("text-generation", model=quantized_model, tokenizer=quantized_tokenizer)


from transformers import AutoTokenizer

# --------------------------------------------------
# 4. ๋™์ผํ•œ ํ”„๋กฌํ”„ํŠธ๋กœ ๊ฐ ๋ชจ๋ธ์— ์ถ”๋ก  ์š”์ฒญ ๋ฐ ๋น„๊ต
# --------------------------------------------------
# ํŒŒ์ธํŠœ๋‹ ๋ฐ์ดํ„ฐ(๊ตฌ์–ด์ฒด)์˜ ํŠน์„ฑ์ด ์ž˜ ๋“œ๋Ÿฌ๋‚˜๋Š” ์งˆ๋ฌธ์„ ์„ ํƒ

tokenizer = AutoTokenizer.from_pretrained(finetuning_model)
if tokenizer.pad_token is None:
    tokenizer.pad_token = tokenizer.eos_token

question = "๊น€์น˜๋ณถ์Œ๋ฐฅ ์žฌ๋ฃŒ๊ฐ€ ๋ญ์•ผ?"
prompt = f"### ์งˆ๋ฌธ:{question}\n\n### ๋‹ต๋ณ€:"

print("\n" + "="*60)
print(f"์งˆ๋ฌธ: {prompt.split('### ๋‹ต๋ณ€:')[0].replace('### ์งˆ๋ฌธ: ', '').strip()}")
print("="*60 + "\n")

# ํŒŒ์ธํŠœ๋‹ & ์–‘์žํ™” ๋ชจ๋ธ ์ถ”๋ก 
print("1. ํŒŒ์ธํŠœ๋‹ ๋ชจ๋ธ ๋‹ต๋ณ€:")
quantized_result = quantized_pipe(
    prompt,
    temperature=0.7,
    eos_token_id=tokenizer.eos_token_id,
    return_full_text=False
)
print(quantized_result[0]['generated_text'])
print("\n" + "="*60)
Downloads last month
5
Safetensors
Model size
2B params
Tensor type
BF16
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support