Қазақша
kaz-qwen-grammar-final — қазақ сөздерін берілген грамматикалық тұлғаға түрлендіретін 20.2 МБ LoRA адаптері. Ол Qwen/Qwen2.5-0.5B-Instruct базалық моделіне қосылып, қазақ тілінің жалғамалы морфологиясымен жұмыс істейді.
Құрылымы
Table with columns: Сипаттама, Мәні| Сипаттама | Мәні |
|---|
| Базалық модель | Qwen/Qwen2.5-0.5B-Instruct |
| Адаптер | LoRA |
| LoRA рангі | 8 |
| LoRA alpha | 16 |
| Кітапхана | PEFT |
| Тапсырма | Грамматикалық тұлға жасау |
Репозиторийде adapter_model.safetensors, адаптер конфигурациясы, tokenizer файлдары және chat template бар. Кіріс сөз бен қажетті грамматикалық санатты атайды, ал модель түрленген нұсқаны жасайды.
Адаптер базалық модельмен бірге жүктеледі.
Қалай іске қосуға болады
from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-0.5B-Instruct")
tokenizer = AutoTokenizer.from_pretrained("TilQazyna/kaz-qwen-grammar-final")
model = PeftModel.from_pretrained(base, "TilQazyna/kaz-qwen-grammar-final")
prompt = "Түрлендір: бала → барыс септік"
inputs = tokenizer(prompt, return_tensors="pt")
output = model.generate(**inputs, max_new_tokens=32)
print(tokenizer.decode(output[0], skip_special_tokens=True))
Қолжетімділік
Модель карточкасы мен файлдар тізімі ашық. Адаптерді жүктеу үшін «Request access» арқылы өтінім беру қажет; шешімді TilQazyna командасы қабылдайды.
Байланысты репозиторийлер
Адаптер kazakh-morpho-grammar деректерімен оқытылған. Осы бағыттағы басқа адаптер — kaz-qwen-morphology-0.5b.
Русский
kaz-qwen-grammar-final — LoRA-адаптер объёмом 20.2 МБ, который образует заданные грамматические формы казахских слов. Он подключается к базовой модели Qwen/Qwen2.5-0.5B-Instruct и обрабатывает агглютинативную морфологию казахского языка.
Устройство
Table with columns: Характеристика, Значение| Характеристика | Значение |
|---|
| Базовая модель | Qwen/Qwen2.5-0.5B-Instruct |
| Адаптер | LoRA |
| Ранг LoRA | 8 |
| LoRA alpha | 16 |
| Библиотека | PEFT |
| Задача | Образование грамматических форм |
Репозиторий содержит adapter_model.safetensors, конфигурацию адаптера, файлы tokenizer и chat template. Во входе указываются слово и требуемая грамматическая категория, после чего модель генерирует изменённую форму.
Как запустить
from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-0.5B-Instruct")
tokenizer = AutoTokenizer.from_pretrained("TilQazyna/kaz-qwen-grammar-final")
model = PeftModel.from_pretrained(base, "TilQazyna/kaz-qwen-grammar-final")
prompt = "Түрлендір: бала → барыс септік"
inputs = tokenizer(prompt, return_tensors="pt")
output = model.generate(**inputs, max_new_tokens=32)
print(tokenizer.decode(output[0], skip_special_tokens=True))
Доступ
Карточка модели и список файлов доступны всем. Для загрузки адаптера требуется заявка через «Request access», которую рассматривает команда TilQazyna.
Связанные репозитории
Адаптер обучен на kazakh-morpho-grammar. Другой адаптер этого направления — kaz-qwen-morphology-0.5b.
English
kaz-qwen-grammar-final is a 20.2 MB LoRA adapter that generates requested grammatical forms of Kazakh words. It attaches to Qwen/Qwen2.5-0.5B-Instruct and handles the agglutinative morphology of Kazakh.
Architecture
Table with columns: Property, Value| Property | Value |
|---|
| Base model | Qwen/Qwen2.5-0.5B-Instruct |
| Adapter | LoRA |
| LoRA rank | 8 |
| LoRA alpha | 16 |
| Library | PEFT |
| Task | Grammatical form generation |
The repository contains adapter_model.safetensors, the adapter configuration, tokenizer files, and a chat template. The input names a word and the required grammatical category, and the model generates the inflected form.
Running the adapter
from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-0.5B-Instruct")
tokenizer = AutoTokenizer.from_pretrained("TilQazyna/kaz-qwen-grammar-final")
model = PeftModel.from_pretrained(base, "TilQazyna/kaz-qwen-grammar-final")
prompt = "Түрлендір: бала → барыс септік"
inputs = tokenizer(prompt, return_tensors="pt")
output = model.generate(**inputs, max_new_tokens=32)
print(tokenizer.decode(output[0], skip_special_tokens=True))
Access
The model card and file list are publicly visible. Adapter downloads require approval through the “Request access” button, with each submission reviewed by the TilQazyna team.
The adapter was trained on kazakh-morpho-grammar. A sibling adapter for this work is kaz-qwen-morphology-0.5b.
Лицензия · License: apache-2.0 · TilQazyna