ArtusDev
nvidia_Llama-3_1-Nemotron-Ultra-253B-v1_EXL3_3.0bpw_H6
Available on FriendliAI
Dedicated Endpoints
Run this model inference on single tenant GPU with unmatched speed and reliability at scale.
Model Details
Model Provider
ArtusDev
Model Tree
Base
nvidia/Llama-3_1-Nemotron-Ultra-253B-v1
Quantized
this modelInput Modalities
Text
Output Modalities
Text
Supported Functionality
Dedicated Endpoints