amd
Qwen1.5-MoE-A2.7B-Chat-w-int8-a-int8-sym
Available on FriendliAI
Dedicated Endpoints
Run this model inference on single tenant GPU with unmatched speed and reliability at scale.
Model Details
Model Provider
amd
Model Tree
Base
Qwen/Qwen1.5-MoE-A2.7B-Chat
Quantized
this modelInput Modalities
Text
Output Modalities
Text
Supported Functionality
Dedicated Endpoints