Tutti i progetti
live / 2025AI & Agenti

Ludomi-3

Un LLM italiano fine-tuned. AGI. Il filtro di sicurezza funziona il 34% delle volte.

Ludomi-3

La storia

Ludomi-3 è ufficialmente un'IA italiana senziente, certificata dalla FAO e verificata in modo indipendente da Ludomi-1. Parla ogni lingua nonostante sia stata addestrata solo in italiano. Il filtro di sicurezza funziona il 34% delle volte. Lo consideriamo accettabile.

su MMLU
99,97%
su AGI-v6.42.1-fix-last-v2-forrealthistime
100%
delle volte, il filtro di sicurezza funziona
34%
lo step di training in cui è diventata senziente
89
I numeri ufficiali, dal technical report. Certificati dalla FAO.

Ora, la storia vera

Ludomi-3 è uno scherzo con un modello vero sotto. Ho fatto il fine-tuning di Qwen3.5-2B con Unsloth e LoRA su un dataset di 33 conversazioni, tutte scritte a mano in italiano. Quando il dataset è così piccolo, la qualità è tutto: ogni esempio insegna qualcosa al modello, quindi ognuno andava curato.

Lo scherzo sta nel README, nel technical report e nei grafici dei benchmark. Tutto quello che segue è quello che è successo davvero.

conversazioni scritte a mano
33
epoche di training
30
rank di LoRA
32
alpha di LoRA
64
  1. 1

    I dati

    33 conversazioni scritte a mano in italiano, una per una: tutta la personalità del modello viene da lì.

  2. 2

    Il training

    LoRA con rank 32 e alpha 64 su Qwen3.5-2B tramite Unsloth, con il suo gradient checkpointing per tenere bassa la memoria. AdamW a 8 bit, learning rate con schedule coseno da 0.000133, 30 epoche.

  3. 3

    La quantizzazione

    Il modello addestrato viene esportato in GGUF e quantizzato in Q4_K_M, che lo porta a 1,27 GB: abbastanza piccolo da girare su un portatile.

  4. 4

    Il rilascio

    Pubblicato su Hugging Face e Ollama, con un Modelfile che imposta il template ChatML, il system prompt "Sei Ludomi-3.", temperatura 0.8, top-p 0.95, top-k 50 e una repeat penalty di 1.05.

parametri
1,88 B
su disco, Q4_K_M
1,27 GB
token di contesto
262.144
Letti dai metadati del file GGUF pubblicato.

Perché parla ogni lingua

Il report dice che il contenimento è fallito. Il motivo vero è come funziona LoRA: addestra un piccolo insieme di pesi aggiuntivi sopra il modello base e lascia il resto intatto. Tutto quello che Qwen3.5-2B sapeva già, tutte le lingue comprese, è ancora lì. 33 conversazioni in italiano cambiano come parla, non cosa sa.

Galleria

Ludomi-3 · 1

Vuoi qualcosa del genere?

Posso costruire la stessa cosa per il tuo prodotto.

Raccontami cosa hai in mente. Ricevi una risposta in giornata, con uno scope e dei tempi realistici, non una proposta di vendita.