fbaldassarri

fbaldassarri

TinyLlama_TinyLlama_v1.1-auto_gptq-int4-gs64-asym

Available on FriendliAI

Dedicated Endpoints

Run this model inference on single tenant GPU with unmatched speed and reliability at scale.

Learn more
Container

Run this model inference with full control and performance in your environment.

Learn more

Model Details

Model Provider

fbaldassarri provider

fbaldassarri

Model Tree

Base

TinyLlama/TinyLlama_v1.1

Quantized
this model

Input Modalities

Text

Output Modalities

Text

Supported Functionality

Dedicated EndpointsContainer

Explore FriendliAI today

TinyLlama_TinyLlama_v1.1-auto_gptq-int4-gs64-asym API & Inference Endpoint | FriendliAI