ArtusDev

ArtusDev

nvidia_Llama-3_1-Nemotron-Ultra-253B-v1_EXL3_3.0bpw_H6

Available on FriendliAI

Dedicated Endpoints

Run this model inference on single tenant GPU with unmatched speed and reliability at scale.

Learn more

Model Details

Model Provider

ArtusDev provider

ArtusDev

Model Tree

Base

nvidia/Llama-3_1-Nemotron-Ultra-253B-v1

Quantized
this model

Input Modalities

Text

Output Modalities

Text

Supported Functionality

Dedicated Endpoints

Explore FriendliAI today