hiyouga/Baichuan-7B-sft · 为什么回答这么长

sunnima

Jul 11, 2023

sunnima

Jul 11, 2023

后面它自己引申了好多问题，自问自答

hiyouga

Owner Jul 12, 2023

用这个代码试试

from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer

tokenizer = AutoTokenizer.from_pretrained("hiyouga/baichuan-7b-sft", trust_remote_code=True)
model = AutoModelForCausalLM.from_pretrained("hiyouga/baichuan-7b-sft", trust_remote_code=True).cuda()
streamer = TextStreamer(tokenizer, skip_prompt=True, skip_special_tokens=True)

query = "晚上睡不着怎么办"
template = "A chat between a curious user and an artificial intelligence assistant. The assistant gives helpful, detailed, and polite answers to the user's questions.\nHuman: {}\nAssistant: "

inputs = tokenizer([template.format(query)], return_tensors="pt")
inputs = inputs.to("cuda")
generate_ids = model.generate(**inputs, max_new_tokens=256, streamer=streamer, do_sample=True, temperature=0.95, top_p=0.7)

xDAN2099

Jul 30, 2023

这个问题是怎么解决的呢

junyi111

Aug 8, 2023

解决了吗？怎么解决引申问题，不让他引申