tbhrc
qwen3_8_9b_mlx_4bit
Available on FriendliAI
Dedicated Endpoints
Run this model inference on single tenant GPU with unmatched speed and reliability at scale.
Model Details
Model Provider
tbhrc
Model Tree
Base
empero-ai/Qwen3.8-9B-Distill
Quantized
this modelInput Modalities
TextImageVideo
Output Modalities
Text
Supported Functionality
Dedicated Endpoints