amazingvince
llama2_xs_233m_GQA-llama-1028-interleaved-deduped-v1-tb-interleaved-deduped-1028-0919
Available on FriendliAI
Dedicated Endpoints
Run this model inference on single tenant GPU with unmatched speed and reliability at scale.
Container
Run this model inference with full control and performance in your environment.
Model Details
Model Provider
amazingvince
Model Tree
Base
amazingvince/llama2_xs_233m_GQA-llama-1028-interleaved-deduped-v1-tb-interleaved-deduped-1028-0919
Fine-tuned
this modelInput Modalities
Text
Output Modalities
Text
Supported Functionality
Dedicated EndpointsContainer