import torch
from transformers import AutoModelForMultimodalLM, AutoProcessor
model_id = "Legal-verse/InaVerdict-gemma-v2"
processor = AutoProcessor.from_pretrained(model_id)
model = AutoModelForMultimodalLM.from_pretrained(
model_id,
dtype=torch.bfloat16,
device_map="auto",
)
messages = [
{
"role": "user",
"content": [
{
"type": "text",
"text": "Jelaskan perbedaan ratio decidendi dan obiter dictum.",
}
],
}
]
inputs = processor.apply_chat_template(
messages,
tokenize=True,
return_dict=True,
return_tensors="pt",
add_generation_prompt=True,
).to(model.device)
input_length = inputs["input_ids"].shape[-1]
with torch.inference_mode():
output_ids = model.generate(**inputs, max_new_tokens=256)
print(
processor.tokenizer.decode(
output_ids[0, input_length:],
skip_special_tokens=True,
)
)