IA locale su hardware di recupero: la serie

Nell’estate del 2026 mi sono messo in testa una domanda sola: un PC del 2013 recuperato può far girare un’intelligenza artificiale in locale, e ne vale la pena? Non in teoria — su quella macchina lì, con quei componenti, misurando tutto.

L’hardware è quello che avevo in casa: un AMD FX-6350 del 2013 e una GTX 750 Ti da 2 GB del 2014, dentro un case che fa già da server per una quindicina di servizi. Stavo per spendere 350 euro per sostituirlo. Questa serie è il racconto di cosa è successo quando, invece di comprare, ho misurato.

La risposta breve, se non hai voglia di leggere tutto

Sì, gira — e il collo di bottiglia non è quasi mai dove te lo aspetti. Non è il processore: è la banda di memoria, al punto che la velocità si prevede con una divisione. Non è la quantità di VRAM in senso graduale: o il modello ci entra tutto o tanto vale non avere la scheda. E nel sistema che ho costruito alla fine, il pezzo che fa il lavoro pesante non è il modello: è il filtro deterministico che decide cosa fargli leggere.

I 350 euro non li ho spesi. Il tempo per scoprirlo: tre pomeriggi.

Prima parte — serve davvero comprare hardware nuovo?

La serie nasce da un annuncio aperto e una carta pronta. Ogni articolo di questa parte è un pezzo della risposta.

Seconda parte — quanto costa tenerlo acceso

  • Quanto consuma davvero un homelab acceso 24/7 — misurato alla presa, non stimato dalle schede tecniche. Durante un’inferenza il gradino è +91 W, e solo il 4,5% viene dalla GPU: il resto è CPU, RAM e alimentazione che salgono di regime insieme a lei. C’è anche il motivo per cui uso la tariffa della bolletta e non il prezzo di mercato dell’energia.
  • Quanto costa davvero far girare un’IA in locale — il confronto con i listini delle API cloud, fatto onestamente. Sul costo per token il cloud vince e non c’è partita: da 5 a 13 volte meno della sola corrente che consumo io.

Terza parte — cosa ci fai davvero

Far girare un modello è la parte facile. La parte che vale la pena raccontare è cosa succede quando gli si dà un lavoro vero.

  • Un assistente AI locale su hardware di recupero funziona davvero? — la misura che quasi nessuno fa prima di montare tutto: quanto è affidabile un modello piccolo nel chiamare gli strumenti. Due modelli fanno lo stesso identico punteggio, 90,6%, con comportamenti opposti: uno sbaglia inventando azioni che nessuno ha chiesto, l’altro no. Sul punteggio sono pari; su un assistente che agisce, non lo sono affatto.
  • Ho messo un LLM locale a leggere i log del mio homelab ogni notte — il primo servizio vero, in produzione da agosto. Nato da un audit manuale che aveva trovato otto guasti silenziosi, fra cui un backup che non era ripristinabile. La conclusione è controintuitiva: il lavoro pesante lo fa il filtro, non il modello.
  • OpenClaw in homelab o su hosting — quando conviene non tenerlo in casa.

In arrivo

Gli articoli già scritti che escono nelle prossime settimane, in ordine. I link compaiono qui man mano che vanno online.

  • Un assistente RAG per interrogare l’homelab via Telegram — e tutto quello che si è rotto quando l’ho usato per davvero.
  • Ho trovato password in chiaro nel mio docker-compose — non stavo facendo un audit di sicurezza.
  • Perché un LLM locale non sa che giorno è — un modello che esegue comandi alla perfezione e sbaglia l’anno su «domani».
  • Mosquitto senza autenticazione — un default pericoloso che funziona lo stesso, ed è il problema.

La regola di questa serie

Ogni numero che trovi in questi articoli l’ho misurato io, su hardware mio. Quando una cosa non l’ho misurata, sta scritto che non l’ho misurata. Quando un numero pubblicato si è rivelato sbagliato o è invecchiato, l’articolo viene corretto con una nota datata invece di essere sistemato in silenzio — è già successo più di una volta, e le note sono ancora lì.

È l’unica cosa che distingue questa serie da una guida compilativa: non che sia più completa, ma che i numeri vengono da una macchina vera con i suoi difetti, accesa in una casa vera.