How to use from the
Use from the
Transformers library
# Use a pipeline as a high-level helper
from transformers import pipeline

pipe = pipeline("text-generation", model="amacca/swlbot")
# Load model directly
from transformers import AutoModel
model = AutoModel.from_pretrained("amacca/swlbot", device_map="auto")
Quick Links

swlbot Β· Qwen2.5-3B fine-tunato per il radioascolto (SWL/BCL)

Modello fine-tunato con QLoRA su dominio radioascolto / Short Wave Listening / BCL in italiano.

Partenza: unsloth/Qwen2.5-3B-bnb-4bit (Qwen2.5-3B Instruct in 4-bit). Dataset: coppie Q&A estratte da radioascoltopratico.org.

πŸ“» Cosa sa fare

  • Tecniche di antenna e ricezione HF
  • Bande broadcasting internazionali e stazioni
  • Ricevitori e software SDR
  • Emittenti internazionali e orari/frequenze tipici
  • Termini tecnici SWL/BCL in italiano

Il modello risponde in italiano, in modo pratico e diretto, con riferimenti concreti a frequenze, stazioni e strumenti reali.

πŸ“¦ Contenuto del repo

File Descrizione
swlbot-Q4_K_M.gguf Modello quantizzato Q4_K_M pronto per Ollama / llama.cpp
adapter/adapter_config.json Config LoRA
adapter/adapter_model.safetensors Adapter LoRA raw (per merge/inference con PEFT)
Modelfile Modelfile Ollama (import in 1 comando)

πŸš€ Utilizzo con Ollama

# Scarica il GGUF da HF (o usa il Modelfile incluso)
ollama create swlbot -f Modelfile
ollama run swlbot "Qual Γ¨ la migliore frequenza per Radio Romania la sera?"

⚠️ Nel Modelfile, modifica il path FROM se carichi il GGUF localmente:

FROM ./swlbot-Q4_K_M.gguf

πŸ§ͺ Dettagli training (QLoRA)

Parametro Valore
Base model unsloth/Qwen2.5-3B-bnb-4bit
Metodo QLoRA (4-bit)
LoRA rank 8
LoRA alpha 16
Target modules q_proj, v_proj, k_proj, o_proj, gate_proj, up_proj
LoRA dropout 0.05
Epochs 3
Learning rate 2e-4
Batch size 1 Γ— 8 (effective 8)
Max seq length 1024
Train examples 255
Eval examples 64
Final loss ~1.33

Export: save_pretrained_gguf di Unsloth (auto-merge LoRA β†’ quantizzazione Q4_K_M).

πŸ”— Link utili

⚠️ Limiti

  • Modello leggero (3B): puΓ² allucinare su frequenze/stazioni specifiche β€” verifica sempre con fonti ufficiali (IARU, ARRL, WRTH).
  • Conoscenza limitata al dataset di training (~255 esempi). Non Γ¨ un manuale radio completo.
  • Ottimizzato per risposte in italiano.

πŸ“ Licenza

AGPL-3.0 (in linea con Unsloth). Deriva da Qwen2.5 (licenza Apache-2.0 del modello base).

Downloads last month
7
GGUF
Model size
3B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for amacca/swlbot

Base model

Qwen/Qwen2.5-3B
Adapter
(81)
this model