nvidia
NVIDIA-Nemotron-3-Nano-4B-FP8
Available on FriendliAI
Dedicated Endpoints
Run this model inference on single tenant GPU with unmatched speed and reliability at scale.
Model Details
Model Provider
nvidia
Model Tree
Base
nvidia/NVIDIA-Nemotron-3-Nano-4B-FP8
Quantized
this modelInput Modalities
Text
Output Modalities
Text
Supported Functionality
Dedicated Endpoints