conecta-primo-gpu / README.md
ConectaPrimoAI's picture
Worker ZeroGPU do Conecta Primo
c7f05a9 verified
|
Raw History Blame Contribute Delete
1.61 kB

A newer version of the Gradio SDK is available: 6.29.1

Upgrade
metadata
title: Conecta Primo GPU
emoji: 🎛️
colorFrom: indigo
colorTo: blue
sdk: gradio
sdk_version: 5.9.1
app_file: app.py
pinned: false
license: mit

Conecta Primo — worker de GPU (ZeroGPU)

Este Space é o adapter ZeroGPU do Conecta Primo AI: a mesma plataforma de geração do repositório principal, rodando os mesmos modelos (modelos/ — Z-Image, Qwen3-TTS, ACE-Step, Wan 2.2) na GPU temporária do Hugging Face. Ele atende somente o backend do app, autenticado por segredo — a página não tem controles de propósito.

O guia completo (criar o Space, secrets, conectar ao Render, testar) está em docs/ZEROGPU.md no repositório principal. O resumo:

  1. Crie um Space Gradio com hardware ZeroGPU.
  2. Publique estes arquivos MAIS modelos/ e armazenamento.py do services/gpu-worker/ (o publicar.sh faz os dois passos).
  3. Em Settings → Variables and secrets:
    • secret WORKER_SECRET — o mesmo valor que irá no Render;
    • secret HF_TOKEN — se algum modelo for gated;
    • secrets STORAGE_* — recomendado (obrigatório na prática para vídeo);
    • variables IMAGE_GPU_SECONDS / TTS_GPU_SECONDS / MUSIC_GPU_SECONDS / VIDEO_GPU_SECONDS — duração de GPU por tipo (padrões: 60/60/180/300).
  4. No Render: GPU_MODE=zerogpu, WORKER_URL=https://<user>-<space>.hf.space e WORKER_SECRET com o mesmo valor.

A quota do ZeroGPU é diária e acaba — o backend trata isso como indisponibilidade (degrada para os geradores locais, ou segura a fila com GERACAO_SO_WORKER=1), nunca como erro para quem usa o app.