inference-optimization

Qwen3.5-397B-A17B-FP8-dynamic-mtp-head

Available on FriendliAI

Dedicated Endpoints

Run this model inference on single tenant GPU with unmatched speed and reliability at scale.

Learn more

Model Details

Model Provider

inference-optimization

Model Tree

Base

Qwen/Qwen3.5-397B-A17B

Quantized
this model

Input Modalities

TextImageVideo

Output Modalities

Text

Supported Functionality

Dedicated Endpoints

Explore FriendliAI today

Qwen3.5-397B-A17B-FP8-dynamic-mtp-head API & Inference Endpoint | FriendliAI