fix(recall): default embed model to Qwen3-Embedding-8B 52b7250 Running verified art87able commited on Jun 15
deploy: multi-backend (minicpm/nemotron/finetuned) + 3-tier ZeroGPU->serverless->local-finetune fallback; finetune pipeline fe7f8fd art87able commited on Jun 15
feat: similar-task recall via Nebius embeddings (keyless; recall degrades off without NEBIUS_API_KEY) 79e91df verified art87able commited on Jun 15
fix(zerogpu): load model with .to(cuda) instead of device_map 012de31 verified art87able commited on Jun 9