google/WaxalNLP
Viewer • Updated • 2.47M • 73.4k • 257
Fine-tuned openai/whisper-small for Kikuyu (Gikuyu) automatic speech recognition.
| Split | WER | CER |
|---|---|---|
| Eval | 78.2% | 40.4% |
| Test | 83.6% | 47.8% |
from transformers import WhisperProcessor, WhisperForConditionalGeneration
processor = WhisperProcessor.from_pretrained("Kiragu/whisper-small-kikuyu-v4")
model = WhisperForConditionalGeneration.from_pretrained("Kiragu/whisper-small-kikuyu-v4")
input_features = processor(audio_array, sampling_rate=16000, return_tensors="pt").input_features
predicted_ids = model.generate(input_features)
transcription = processor.batch_decode(predicted_ids, skip_special_tokens=True)[0]
This model is part of Sauti AI, a decentralized vocal data collection platform for underrepresented languages.
Base model
openai/whisper-small