מה יש כאן
קובץ אחד: model.safetensors, בגודל 16.0 ג'יגה-בייט, ולצידו ה-tokenizer ותבנית השיחה.
אלה אותן משקולות כמו במאגר הראשי, בפורמט אחר. המאגר הראשי מחזיק גרסה דחוסה שרצה על מחשב פיתוח רגיל. כאן יושבת הגרסה המלאה — גדולה יותר, ומיועדת לעבודה על המודל, לא רק להרצה שלו.
מתי לקחת את הגרסה הזו
- טעינה עם
transformers בפייתון.
- המשך אימון על בסיס הקוד הפרטי של החברה שלך.
- המרה ל-ONNX או לפורמט הרצה אחר.
- מסגרת עבודה שלא יודעת לקרוא GGUF.
מתי לא לקחת אותה
אם אתה רק רוצה להריץ את המודל ולכתוב איתו קוד — קח את המאגר הראשי, BrainboxAI/code-il-E4B. הוא קטן בהרבה, עובד ישר מול Ollama או LM Studio, ולא ייתן תשובות פחות טובות.
איך טוענים
from transformers import AutoTokenizer, AutoModelForCausalLM
tokenizer = AutoTokenizer.from_pretrained("BrainboxAI/code-il-E4B-safetensors")
model = AutoModelForCausalLM.from_pretrained(
"BrainboxAI/code-il-E4B-safetensors",
torch_dtype="auto",
device_map="auto",
)
messages = [
{"role": "user", "content": "Implement binary search in TypeScript with full edge-case handling."},
]
inputs = tokenizer.apply_chat_template(messages, return_tensors="pt", add_generation_prompt=True)
outputs = model.generate(inputs, max_new_tokens=1024, temperature=0.2, top_p=0.95)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))
המשך אימון
זה המאגר הנכון להתחיל ממנו אם רוצים לאמן הלאה על קוד פנימי. מתחילים מכאן ולא מ-Gemma המקורי, כדי לשמור על האימון שכבר נמצא במודל.
הכרטיס המלא נמצא במקום אחר
על מה המודל אומן, מה הוא יודע, ובעיקר מה הוא לא יודע — הכל כתוב בכרטיס של המאגר הראשי:
BrainboxAI/code-il-E4B
המאגרים של המודל הזה
רישיון
Apache 2.0.
זהו אימון-המשך של unsloth/gemma-4-E4B-it, ולכן התנאים של מודל הבסיס חלים גם כאן. מודל הבסיס מפורסם תחת Apache 2.0 ומפנה גם אל תנאי השימוש של Gemma.
מי בנה את זה
נבנה על ידי נתנאל אליאסי, מייסד BrainboxAI — סטודיו ישראלי לבינה מלאכותית יישומית, שבונה מודלים קטנים, פרטיים ומתמחים.
שאלות, תיקונים, או צורך שהמודל הזה לא עונה עליו: netanele@brainboxai.io.
חלק ממשפחת המודלים של BrainboxAI שרצים על החומרה שלך. ראה גם law-il-E2B (משפט) ו-cyber-analyst-4B (סייבר).