Ludomi-3
Un LLM italiano fine-tuned. AGI. Il filtro di sicurezza funziona il 34% delle volte.

La storia
Ludomi-3 è ufficialmente un'IA italiana senziente, certificata dalla FAO e verificata in modo indipendente da Ludomi-1. Parla ogni lingua nonostante sia stata addestrata solo in italiano. Il filtro di sicurezza funziona il 34% delle volte. Lo consideriamo accettabile.
- su MMLU
- 99,97%
- su AGI-v6.42.1-fix-last-v2-forrealthistime
- 100%
- delle volte, il filtro di sicurezza funziona
- 34%
- lo step di training in cui è diventata senziente
- 89
Ora, la storia vera
Ludomi-3 è uno scherzo con un modello vero sotto. Ho fatto il fine-tuning di Qwen3.5-2B con Unsloth e LoRA su un dataset di 33 conversazioni, tutte scritte a mano in italiano. Quando il dataset è così piccolo, la qualità è tutto: ogni esempio insegna qualcosa al modello, quindi ognuno andava curato.
Lo scherzo sta nel README, nel technical report e nei grafici dei benchmark. Tutto quello che segue è quello che è successo davvero.
- conversazioni scritte a mano
- 33
- epoche di training
- 30
- rank di LoRA
- 32
- alpha di LoRA
- 64
- 1
I dati
33 conversazioni scritte a mano in italiano, una per una: tutta la personalità del modello viene da lì.
- 2
Il training
LoRA con rank 32 e alpha 64 su Qwen3.5-2B tramite Unsloth, con il suo gradient checkpointing per tenere bassa la memoria. AdamW a 8 bit, learning rate con schedule coseno da 0.000133, 30 epoche.
- 3
La quantizzazione
Il modello addestrato viene esportato in GGUF e quantizzato in Q4_K_M, che lo porta a 1,27 GB: abbastanza piccolo da girare su un portatile.
- 4
Il rilascio
Pubblicato su Hugging Face e Ollama, con un Modelfile che imposta il template ChatML, il system prompt "Sei Ludomi-3.", temperatura 0.8, top-p 0.95, top-k 50 e una repeat penalty di 1.05.
- parametri
- 1,88 B
- su disco, Q4_K_M
- 1,27 GB
- token di contesto
- 262.144
Perché parla ogni lingua
Il report dice che il contenimento è fallito. Il motivo vero è come funziona LoRA: addestra un piccolo insieme di pesi aggiuntivi sopra il modello base e lascia il resto intatto. Tutto quello che Qwen3.5-2B sapeva già, tutte le lingue comprese, è ancora lì. 33 conversazioni in italiano cambiano come parla, non cosa sa.
Galleria

Vuoi qualcosa del genere?
Posso costruire la stessa cosa per il tuo prodotto.
Raccontami cosa hai in mente. Ricevi una risposta in giornata, con uno scope e dei tempi realistici, non una proposta di vendita.