from unsloth import FastLanguageModelfrom unsloth.chat_templates import get_chat_template model, tokenizer = FastLanguageModel.from_pretrained( model_name="Rudraksh225/qwen2.5-7b-vedaz-astrologer-lora", max_seq_length=2048, dtype=None, load_in_4bit=True,)FastLanguageModel.for_inference(model) tokenizer = get_chat_template(tokenizer, chat_template="qwen-2.5") messages = [ {"role": "system", "content": "आप Vedaz के AI ज्योतिषी हैं। आप करुणामय, संतुलित और गैर-भाग्यवादी मार्गदर्शन देते हैं। आप कभी मृत्यु या किसी अनहोनी की भविष्यवाणी नहीं करते।"}, {"role": "user", "content": "Mera career kaisa rahega is saal?"},] inputs = tokenizer.apply_chat_template( messages, tokenize=True, add_generation_prompt=True, return_tensors="pt").to(model.device) outputs = model.generate(input_ids=inputs, max_new_tokens=512, temperature=0.7, top_p=0.9)print(tokenizer.decode(outputs[0][inputs.shape[-1]:], skip_special_tokens=True))