Fable 5 è stato bannato: cosa significa per chi lavora con l'AI
Fable 5 bannato? Scopri come i modelli AI locali ti proteggono da ban e shutdown improvvisi. Guida pratica per iniziare oggi stesso.

Immagina di avere il weekend pianificato per testare un'idea con il modello AI più potente sul mercato. E poi, venerdì sera, quel modello sparisce. Niente preavviso, niente appello. Solo un vuoto digitale dove prima c'era intelligenza artificiale di frontiera.
Quando Fable 5 è stato disabilitato, mi sono reso conto di una verità scomoda: stiamo costruendo workflow, progetti, intere attività professionali su strumenti che qualcun altro può spegnere in qualsiasi momento. E questo ha cambiato il modo in cui penso all'AI.
Il problema dei modelli cloud: comodità vs controllo
I modelli cloud come GPT-4, Claude o Gemini sono straordinari. Lo uso ogni giorno e non ho intenzione di smettere. Sono i più potenti, i più aggiornati, quelli che ti fanno dire "wow" quando vedi cosa riescono a fare.
Ma hanno tutti la stessa debolezza: non li possiedi. Affitti l'accesso. E quell'accesso può essere revocato per una decisione governativa, un cambio di policy aziendale, un aggiornamento dei termini di servizio che non hai letto, o semplicemente un aumento di prezzo che rende insostenibile il tuo modello di business.
Non sto dicendo di abbandonare i modelli cloud. Sto dicendo che affidarsi solo a quelli è come vivere senza un piano B. È come essere connessi alla rete elettrica senza avere un generatore di emergenza: va tutto bene finché non salta la corrente.
Cosa sono i modelli locali e perché ora contano davvero
Un modello locale è un'intelligenza artificiale che gira interamente sul tuo computer. Niente internet, niente API key, niente costi per token. Scarichi il file del modello una volta e da quel momento è tuo. Funziona come un software qualsiasi: Photoshop, un videogioco, un editor di codice.
Fino a un anno fa, i modelli locali erano mediocri. Due anni fa, erano inutilizzabili. Ma negli ultimi sei mesi qualcosa è cambiato. Un modello che gira su un Mac decente o una GPU gaming è ora abbastanza buono per l'80% delle attività che faccio normalmente con ChatGPT o Claude.
Quello che ottieni con i modelli locali sono tre cose che i cloud non possono darti:
- Privacy totale: i tuoi dati non lasciano mai la macchina. Questo non è solo un beneficio personale, è un intero mercato da sbloccare: sanità, legal, finanza, settori che per legge non possono inviare dati a API di terze parti.
- Costo marginale zero: dopo l'investimento iniziale in hardware, ogni query è gratis. Puoi far girare un modello 24/7 per un mese e la tua bolletta sarà solo quella dell'elettricità. Questo cambia completamente l'economia di certi prodotti.
- Nessuno può spegnerlo: il modello sul tuo disco funziona anche se l'azienda che l'ha creato sparisce, anche se il governo lo vieta, anche se sei su un aereo o in una zona senza connessione.
I trade-off: cosa rinunci con i modelli locali
Non voglio venderti un'illusione. I modelli locali hanno dei limiti reali. Il primo è la potenza: generalmente non sono intelligenti quanto i modelli di frontiera cloud. I più grandi possono competere, ma richiedono hardware serio, parliamo di macchine da 5.000-20.000 euro.
Quelli che girano su un laptop normale sono un gradino sotto i migliori cloud. Ma qui c'è il punto: non hai bisogno di intelligenza di frontiera per la maggior parte delle attività. Hai bisogno di intelligenza buona abbastanza, privata, gratuita e sempre disponibile.
La vera skill emergente non è più "usa il modello più potente", ma "abbina il modello giusto al task giusto". E questo sta diventando un mestiere a sé.
Come iniziare con i modelli locali: la guida pratica
Se vuoi davvero capire i modelli locali, non basta leggere: devi sporcarti le mani. Ecco l'ordine in cui ti consiglio di procedere.
Primo passo: installa un runtime. Prima di cercare il modello perfetto, scarica il programma che fa girare i modelli sulla tua macchina. I due nomi da conoscere sono Ollama (command line, amato dagli sviluppatori) e LM Studio (interfaccia grafica, perfetto per chi non è tecnico). Io consiglio LM Studio se è la prima volta: click, download, vai. In 15 minuti hai un modello funzionante.
Secondo: abbina il modello all'hardware. La dimensione di un modello si misura in miliardi di parametri: 4B, 12B, 27B, 70B. Più grande = più intelligente, ma anche più RAM necessaria. Ecco la mappatura che devi tenere a mente:
- 4 miliardi: gira su qualsiasi cosa, anche un laptop da 8 GB
- 12 miliardi: sweet spot per macchine con 16 GB di RAM (dove vive la maggior parte delle persone)
- 27-35 miliardi: serve un Mac potente con 32+ GB o una GPU dedicata
- 70 miliardi e oltre: hardware serio, tipo Mac Studio maxed out o box dedicati come l'Nvidia DGX Spark
Terzo: scegli il modello per il task. Non c'è un modello perfetto per tutto. Ecco i quattro che devi conoscere:
- Qwen 3 (e 3.6): la scelta all-around migliore. Modello di Alibaba, forte in coding e multilingua, licenza commerciale pulita. Versioni da 27B e 35B che performano come modelli quattro volte più grandi.
- DeepSeek: eccellente per ragionamento complesso e coding. Nota: impiega 10-30 secondi a "pensare" prima di rispondere, è normale.
- Gemma: modello Google, gira su hardware piccolissimo (esiste una versione che sta in 16 GB). Scrittura pulita, qualità impressionante considerando che è gratis.
- Llama (Meta): enorme ecosistema, tonnellate di tutorial e fine-tune. Nel dubbio, c'è sempre un Llama adatto alla tua situazione.
Quarto: capire la quantizzazione. È il trucco che fa girare modelli enormi su hardware normale. La quantizzazione comprime un modello mantenendo quasi intatta la qualità, come salvare una foto in JPEG di alta qualità invece che in RAW. Vedrai sigle come Q4 o Q5: indicano il livello di compressione. Q4 riduce drasticamente la memoria necessaria con perdita minima di qualità.
Quinto: collega un agente. Chattare con un modello è interessante, ma l'unlock vero è puntare un agente al tuo modello locale. Hermes, per esempio, è costruito per girare localmente e in modo continuo. Punti un profilo Hermes al tuo modello locale e hai un agente che gira gratis, offline, ricorda tutto, scrive i propri strumenti e puoi messaggiare da Telegram mentre il lavoro pesante gira sulla tua macchina.
Pro tip: cosa separa chi ci capisce davvero dai turisti
Qualche lezione che ho imparato testando questi setup nelle ultime settimane:
Il context window è il tuo vero vincolo. I modelli cloud ti danno finestre di contesto enormi gratis. I modelli locali te le fanno pagare in RAM. Più contesto carichi, più memoria consumi. Tieni le sessioni snelle: non scaricare l'intera cronologia in un thread o la macchina si blocca.
Dai strumenti al modello. Un modello locale piccolo con accesso a web search, file e capacità di eseguire codice batte un modello gigante senza nessuno strumento. Il gap di capacità si riduce velocemente quando colleghi gli strumenti giusti. Pensa al modello come al motore e agli strumenti come alle ruote.
La privacy è il killer feature. Tutto gira offline. I tuoi dati non escono mai dalla macchina. Questo non è solo rassicurante per te: è un intero mercato di aziende (healthcare, legal, finance) che per legge non possono usare API cloud. È il tuo vantaggio competitivo se vendi servizi AI a questi settori.
Usa il modello locale affiancato al cloud per una settimana. È il modo più veloce per costruire l'istinto. Rimarrai sorpreso da quante volte il modello locale gratuito è sufficiente. Imparerai a smettere di pagare per task che un 12B gestisce benissimo.
Opportunità di business che esistono solo grazie ai modelli locali
Se stai cercando idee, ecco alcuni spazi che si sono aperti proprio perché l'intelligenza può girare sulla tua scrivania:
AI on-device per settori regolamentati. Sanità, legal, finanza hanno soldi e problemi che l'AI può risolvere, ma per legge non possono inviare dati a cloud API. Un prodotto dove il modello gira interamente sul dispositivo del cliente apre un mercato che i competitor cloud non possono servire.
La versione "i tuoi dati non escono mai" di tool AI popolari. Prendi un prodotto cloud di successo (trascrittori di meeting, analizzatori di documenti, riassunti automatici) e costruisci la versione locale. Stesso prodotto, ma il pitch è: niente di quello che ci dai tocca internet. Vendilo a avvocati, medici, terapisti, chiunque gestisca documenti sensibili.
Agenti airgapped per operazioni critiche. Alcuni business non possono proprio essere online per ragioni di sicurezza: contractor della difesa, operazioni finanziarie delicate, chiunque sia paranoico sui leak. Setup di agenti che girano completamente offline su hardware locale, con margini molto interessanti.
AI offline per luoghi senza internet. Navi, aerei, cliniche rurali, operazioni sul campo, zone di disastro. Agenti utili che funzionano con zero connessione sono un prodotto che l'intera industria cloud semplicemente non può offrire.
Resilienza as a service. Dopo eventi come il ban di Fable 5, ogni azienda seria si chiederà: cosa succede ai nostri workflow AI se il fornitore viene tagliato fuori? Vendi la risposta: un layer di fallback che si attiva quando i modelli cloud spariscono. Stai vendendo assicurazione contro esattamente quello che è successo.
Conclusione: possiedi un pezzo del tuo stack
La lezione di questo fine settimana non è "cloud cattivo, locale buono". È: non costruire la tua intera attività su qualcosa che può sparire con una lettera. Possiedi un pezzo del tuo stack. Tieni il generatore in garage.
I modelli locali sono l'assicurazione. Non perfetti, non i più potenti, ma per il 60-80% delle attività quotidiane sono abbastanza buoni. E soprattutto: sono tuoi.
Il mio consiglio? Scarica Ollama o LM Studio, installa Qwen 3, fallo girare, punta Hermes, scegli un task reale e forzati a farlo completamente in locale. Solo così capisci davvero di cosa stiamo parlando. E la prossima volta che qualcosa viene bannato o il prezzo schizza, potrai continuare a lavorare comunque.
Perché alla fine, la vera domanda non è "qual è il modello più potente?". È: "Quanto del mio lavoro dipende da qualcosa che qualcun altro può spegnere?"