conecta-primo-gpu / README.md
ConectaPrimoAI's picture
Worker ZeroGPU do Conecta Primo
c7f05a9 verified
|
Raw History Blame Contribute Delete
1.61 kB
---
title: Conecta Primo GPU
emoji: 🎛️
colorFrom: indigo
colorTo: blue
sdk: gradio
sdk_version: "5.9.1"
app_file: app.py
pinned: false
license: mit
---
# Conecta Primo — worker de GPU (ZeroGPU)
Este Space é o **adapter ZeroGPU** do Conecta Primo AI: a mesma plataforma de
geração do repositório principal, rodando os mesmos modelos
(`modelos/` — Z-Image, Qwen3-TTS, ACE-Step, Wan 2.2) na GPU temporária do
Hugging Face. Ele atende **somente** o backend do app, autenticado por
segredo — a página não tem controles de propósito.
O guia completo (criar o Space, secrets, conectar ao Render, testar) está em
`docs/ZEROGPU.md` no repositório principal. O resumo:
1. Crie um Space **Gradio** com hardware **ZeroGPU**.
2. Publique estes arquivos MAIS `modelos/` e `armazenamento.py` do
`services/gpu-worker/` (o `publicar.sh` faz os dois passos).
3. Em *Settings → Variables and secrets*:
- secret `WORKER_SECRET` — o mesmo valor que irá no Render;
- secret `HF_TOKEN` — se algum modelo for *gated*;
- secrets `STORAGE_*` — recomendado (obrigatório na prática para vídeo);
- variables `IMAGE_GPU_SECONDS` / `TTS_GPU_SECONDS` /
`MUSIC_GPU_SECONDS` / `VIDEO_GPU_SECONDS` — duração de GPU por tipo
(padrões: 60/60/180/300).
4. No Render: `GPU_MODE=zerogpu`, `WORKER_URL=https://<user>-<space>.hf.space`
e `WORKER_SECRET` com o mesmo valor.
A quota do ZeroGPU é **diária e acaba** — o backend trata isso como
indisponibilidade (degrada para os geradores locais, ou segura a fila com
`GERACAO_SO_WORKER=1`), nunca como erro para quem usa o app.