import torch
from transformers import AutoModelForCausalLM, AutoTokenizer
model_id = "RahulPi/qwen2.5-1.5B-sql"
tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(
model_id,
torch_dtype=torch.float16,
device_map="auto"
)
context = "CREATE TABLE head (born_state VARCHAR, age INTEGER)"
question = "How many heads were born in California and are older than 50?"
prompt = (
f"System: You are a strict SQL assistant. Output ONLY valid SQL queries.\n"
f"User: Schema: {context} Question: {question}\n"
f"Assistant:"
)
inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
outputs = model.generate(**inputs, max_new_tokens=128)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))