from transformers import AutoModelForCausalLM, AutoTokenizer
import torch
model = AutoModelForCausalLM.from_pretrained(
"stukenov/ekitil-core-qwen3-600m-kkru-translate-v1",
dtype=torch.bfloat16, device_map="auto"
)
tokenizer = AutoTokenizer.from_pretrained("stukenov/ekitil-core-qwen3-600m-kkru-translate-v1")
prompt = "<|kk|> Қазақстан — Орталық Азиядағы ең үлкен мемлекет. <|translate|> <|ru|>"
ids = tokenizer.encode(prompt, return_tensors="pt").to(model.device)
out = model.generate(ids, max_new_tokens=100, repetition_penalty=1.3, eos_token_id=tokenizer.eos_token_id)
print(tokenizer.decode(out[0][ids.shape[1]:], skip_special_tokens=True))
prompt = "<|ru|> Образование является ключом к успеху. <|translate|> <|kk|>"
ids = tokenizer.encode(prompt, return_tensors="pt").to(model.device)
out = model.generate(ids, max_new_tokens=100, repetition_penalty=1.3, eos_token_id=tokenizer.eos_token_id)
print(tokenizer.decode(out[0][ids.shape[1]:], skip_special_tokens=True))