Count the GPU call from outside, where the result survives 2e783b7 Running verified Monstermango commited on 15 days ago
Fewer GPU calls, faster attention, optional second pass 1320bbc verified Monstermango commited on 15 days ago
Actually set the estimate before the first section 17d45b1 verified Monstermango commited on 15 days ago
Convert the audio in the job, not in the request 2091812 verified Monstermango commited on 15 days ago
Save the background result instead of holding it in RAM e90e8b3 verified Monstermango commited on 15 days ago
Give the push send a deadline and a valid sub claim f9707d5 verified Monstermango commited on 16 days ago
Carry the caller's context into the worker thread f4d0ace verified Monstermango commited on 16 days ago
Run the pipeline server-side and push when done 0a60891 verified Monstermango commited on 16 days ago
Probe: which quota does background work draw on? aead346 verified Monstermango commited on 16 days ago
Probe: can GPU work start without a live request? 7df9107 verified Monstermango commited on 16 days ago
Cross-check, confidence, voice prints, quality, learning da1aad0 verified Monstermango commited on 16 days ago
Split pure logic into kern.py; delete audio after analysis 38b72c2 verified Monstermango commited on 16 days ago
Keep the raw transcript and mark heavily smoothed lines 29bda12 verified Monstermango commited on 16 days ago
Drop the Whisper prompt that silenced recognition 643344f verified Monstermango commited on 16 days ago
Automatic ranked glossary and language-model smoothing pass 3814b61 verified Monstermango commited on 16 days ago
Persistent glossary feeding recognition across recordings 2df8c4d verified Monstermango commited on 16 days ago
Make section processing idempotent for safe retries 7d36ce2 verified Monstermango commited on 16 days ago
Do not depend on model timestamps; align window text instead 85a602e verified Monstermango commited on 16 days ago
Use a German-finetuned Whisper for German audio 37dc570 verified Monstermango commited on 16 days ago
Word-level speaker assignment, audio normalisation, beam search 6a3ed2f verified Monstermango commited on 16 days ago
Add status endpoint reporting HF token presence 559f98e verified Monstermango commited on 17 days ago
Optional: align a supplied transcript instead of running ASR 07c52bc verified Monstermango commited on 17 days ago
whisper-large-v3 and pinned language to stop English translation c0181af verified Monstermango commited on 17 days ago
Stepwise API so long recordings survive GPU token expiry 38d0695 verified Monstermango commited on 18 days ago
Support long recordings: windowed transcription, progress abf3ac2 verified Monstermango commited on 18 days ago
Full-audio transcription, language detection, save with speaker names 0e55d28 verified Monstermango commited on 18 days ago
Include generated markdown in analysis response 82e7aa3 verified Monstermango commited on 19 days ago
Mobile-first UI: responsive CSS, card history, touch targets 99d2635 verified Monstermango commited on 19 days ago
Single-flow UI: full analysis without use-case selection 4676a9f verified Monstermango commited on 19 days ago
Disable SSR mode (incompatible with Gradio auth on Spaces) 17e2287 verified Monstermango commited on 19 days ago