Pino : GGUF

Pino es un modelo de lenguaje multimodal basado en Qwen3.5-4B, afinado con un dataset que contiene información de la Pontificia Universidad Católica Madre y Maestra (PUCMM). Está diseñado para responder preguntas relacionadas con la universidad: oferta académica, servicios, procesos administrativos y vida estudiantil, entre otros temas.

Este modelo fue convertido al formato GGUF usando Unsloth, lo que permite ejecutarlo de forma eficiente en local con llama.cpp.

Uso

Ejemplos de ejecución:

  • Para LLMs de solo texto:
  llama-cli -hf sabux/Pino --jinja
  • Para modelos multimodales:
  llama-mtmd-cli -hf sabux/Pino --jinja

Archivos disponibles

Archivo Descripción
Qwen3.5-4B.BF16-mmproj.gguf Proyector multimodal (mmproj) en precisión BF16, necesario para las capacidades de visión.
Qwen3.5-4B.Q4_K_M.gguf Modelo base cuantizado a 4 bits (Q4_K_M), buen equilibrio entre tamaño y calidad.

Detalles del modelo

  • Modelo base: Qwen3.5-4B
  • Idioma principal: Español
  • Dominio: Información institucional de la PUCMM
  • Formato: GGUF (compatible con llama.cpp)
  • Herramienta de conversión: Unsloth

Notas

  • El proyector mmproj es necesario únicamente si deseas usar las capacidades multimodales (visión). Para uso de solo texto, basta con el archivo Q4_K_M.
  • Este modelo puede generar información inexacta. Verifica siempre los datos oficiales en los canales institucionales de la PUCMM.
Downloads last month
121
GGUF
Model size
4B params
Architecture
qwen35
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for sabux/pino

Finetuned
Qwen/Qwen3.5-4B
Quantized
(467)
this model