RedHatAI
Qwen3-Next-80B-A3B-Thinking-quantized.w4a16
Available on FriendliAI
Dedicated Endpoints
Run this model inference on single tenant GPU with unmatched speed and reliability at scale.
Model Details
Model Provider
RedHatAI
Model Tree
Base
Qwen/Qwen3-Next-80B-A3B-Thinking
Quantized
this modelInput Modalities
Text
Output Modalities
Text
Supported Functionality
Dedicated Endpoints