Video-Text-to-Text
Transformers
Safetensors
llava_next_video
image-text-to-text
llava
video
sign-language
multimodal
Instructions to use Remostart/sign-language with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Remostart/sign-language with Transformers:
# Load model directly from transformers import AutoProcessor, AutoModelForMultimodalLM processor = AutoProcessor.from_pretrained("Remostart/sign-language") model = AutoModelForMultimodalLM.from_pretrained("Remostart/sign-language", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Sign Language Translation Model (LLaVA Fine-tuned)
This is a fine-tuned version of LLaVA-NeXT-Video-7B for sign language translation.
Usage
from transformers import LlavaNextVideoForConditionalGeneration, AutoProcessor
import torch
model = LlavaNextVideoForConditionalGeneration.from_pretrained("Remostart/sign-language")
processor = AutoProcessor.from_pretrained("Remostart/sign-language")
- Downloads last month
- 41
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐ 2 Ask for provider support
Model tree for Remostart/sign-language
Base model
llava-hf/LLaVA-NeXT-Video-7B-hf