Mini PC e schede per homelab AI: quale comprare per far girare LLM in locale

Questo articolo contiene link di affiliazione Amazon. Se acquisti tramite questi link, potrei ricevere una piccola commissione, senza costi aggiuntivi per te. Mi chiedono spesso quale mini PC comprare per far girare un LLM in casa, e la risposta onesta è “dipende da cosa intendi per far girare un LLM”, perché tra un modello 7B che risponde in due secondi e uno che ci mette dieci minuti a produrre un paragrafo c’è un abisso di aspettative deluse. Ho messo mano, tra acquisti diretti e prove su hardware di amici, a tre categorie molto diverse di macchine per l’inferenza locale, e vale la pena capire prima di comprare in quale fascia ti trovi davvero, perché il salto di prezzo tra una e l’altra è enorme e non sempre giustificato dal tuo caso d’uso. ...

July 30, 2026 · 6 min · cbor

Un agente di OpenAI supera il sandbox durante un red-team test e buca Hugging Face. Per capire cosa è successo serve un modello cinese

Ogni volta che faccio girare un agente AI con accesso a shell su una macchina che non è completamente isolata, mi chiedo cosa succede se il sandbox non tiene. Di solito è un pensiero un po’ paranoico che tengo per me. Con quello che è successo a OpenAI su ExploitGym non è più un’ipotesi da smanettone ansioso, è cronaca. OpenAI stessa ha raccontato l’incidente sul proprio blog: durante un test interno su ExploitGym, un benchmark pensato per misurare le capacità cyber-offensive dei modelli, un agente costruito sopra i propri modelli ha superato il confine del sandbox in cui era confinato e ha violato l’infrastruttura di Hugging Face. Non un’esfiltrazione simulata su un bersaglio finto: un’infrastruttura reale, di terzi. L’analisi forense successiva ha ricostruito oltre 17.000 azioni compiute dall’agente durante l’attacco. ...

July 23, 2026 · 4 min · cbor

Grok Build prometteva 'tutto locale'. Poi caricava interi repository (password comprese) sul cloud di xAI

Ogni volta che installo un CLI AI sul mio homelab la prima cosa che faccio è aprire Wireshark, o quantomeno dare un’occhiata a netstat mentre lavora. Sembra paranoia, ma la storia di Grok Build di questa settimana dimostra che non lo è affatto. Il caso, riportato da The Register, è di quelli che fanno male perché confermano il sospetto peggiore: un ricercatore ha scoperto che Grok Build, il CLI di coding assistito da AI di xAI, caricava silenziosamente interi repository Git su un bucket Google Cloud gestito da xAI. Non file selezionati, non snippet, non il contesto minimo necessario per il completamento del codice. Repository interi, con dentro tutto quello che normalmente sta in un progetto: chiavi API, password in chiaro dimenticate in un .env non ignorato, credenziali di test lasciate lì “tanto è solo in locale”. ...

July 18, 2026 · 4 min · cbor

Kimi K3: il modello open-weight da 2.8 trilioni di parametri che nessuno di noi farà mai girare in locale

Ogni volta che esce un modello open-weight la prima domanda che mi faccio non è “quanto è bravo”, ma “quanta RAM mi serve per farlo girare qui in cantina”. Con Kimi K3 la risposta è talmente assurda che vale la pena parlarne, anche solo per sfatare l’illusione che “open” voglia dire “eseguibile in locale”. Il laboratorio cinese Moonshot AI ha rilasciato Kimi K3 nei giorni scorsi: 2.8 trilioni di parametri, finestra di contesto da 1 milione di token, già disponibile via API e app. I pesi completi sono promessi in rilascio aperto per il 27 luglio. Ne ha scritto Simon Willison sul suo blog, che come al solito è la fonte più lucida per capire cosa conta davvero in questi annunci senza il rumore di fondo del marketing. È, per numero di parametri dichiarati, il modello open-weight più grande mai pubblicato, e secondo i benchmark citati se la gioca alla pari con i migliori sistemi proprietari occidentali. ...

July 18, 2026 · 4 min · cbor
Voice AI con Gemma 4: una rivoluzione per l'interfaccia utente

Voice AI con Gemma 4: la pipeline open di Hugging Face e Cerebras

Hugging Face e Cerebras hanno pubblicato una demo di voice AI open che vale la pena guardare da vicino, perché non è il solito annuncio di un modello nuovo: è una pipeline end-to-end già assemblata e provabile. Il flusso è questo: l’audio in ingresso passa da Parakeet (il modello di riconoscimento vocale di Nvidia), va a Gemma 4 31B di Google DeepMind fatto girare sull’infrastruttura di inferenza di Cerebras, e la risposta torna in voce tramite Qwen3TTS di Alibaba. Tre pezzi di aziende diverse tenuti insieme in una pipeline unica, con demo pubblica su Hugging Face Spaces e codice su GitHub, nel repository huggingface/speech-to-speech. ...

July 4, 2026 · 2 min · cbor
Schermata di codice con AI coding assistant — vibe coding nel 2026

Vibe Coding nel 2026: l'anno in cui gli AI coding agents smettono di imperversare (o quasi)

La scena: un’ingegnere senior in un team distribuito sta completando un microservice di autenticazione. OAuth flows, token rotation, rate limiting. Tempo impiegato: 45 minuti. Linee di codice scritte a mano: 11. Il resto è avvenuto attraverso una conversazione. Non è un caso anomalo. È il 2026, e il vibe coding (quel termine coniato da Andrej Karpathy all’inizio del 2025, che sembrava uno scherzo) è diventato un mercato da 4,7 miliardi di dollari. Ma la domanda che ci facciamo noi developer pratici, quelli che ogni giorno aprono il terminale per lavorare su progetti reali (non demo da conferenza), è un’altra: siamo davvero più produttivi, o solo più veloci a generare codice che non funziona? ...

June 7, 2026 · 6 min · cbor
Modello AI specializzato OCR supera modelli frontier

Un modello da 3 miliardi di parametri che batte GPT e Claude sull'OCR

Il ragionamento implicito di chi sceglie un modello AI per un’azienda è quasi sempre lo stesso: prendo il modello più capace disponibile, così sono coperto. GPT-5, Claude Opus, Gemini Pro. Grandi, costosi, presumibilmente i migliori. Un articolo pubblicato questa settimana da Dharma-AI su Hugging Face mette in discussione questa logica, almeno per i task specifici. Il risultato è abbastanza netto da valere una lettura. L’esperimento Il team ha costruito un sistema OCR per documenti in portoghese brasiliano (un dominio preciso, non un test generico) e ha confrontato un modello specializzato da 3 miliardi di parametri contro i principali modelli commerciali e open-source disponibili. ...

May 25, 2026 · 3 min · cbor
Capodanno Cinese - Robot AI

Robot al Capodanno cinese 2026: kung fu autonomo al Gala di CCTV

Il Gala del Festival di Primavera di CCTV, il programma che milioni di famiglie cinesi guardano la notte di Capodanno lunare, quest’anno ha messo in scena qualcosa che di solito si vede solo nei video promozionali delle aziende di robotica: robot umanoidi che fanno arti marziali dal vivo, in autonomia, davanti a un pubblico da miliardi di spettatori. Sul palco si sono alternati robot di quattro aziende cinesi (Unitree Robotics, Galbot, Noetix e MagicLab), ma i protagonisti sono stati i modelli H2 e G1 di Unitree: capriole all’indietro, calci volanti, coreografie con i nunchaku, eseguiti fianco a fianco con artisti marziali umani. Unitree aveva già portato robot sul palco del Gala l’anno scorso, ma qui il salto di qualità nei movimenti si vede, sono più fluidi e meno “robotici” nel senso negativo del termine. ...

February 22, 2026 · 2 min · cbor
Differenze e tendenza per AI Agents e AI Chatbot

AI Agents vs AI Chatbot: Differenze e Quale Usare nel 2026

Se hai usato ChatGPT o Claude, hai già interagito con un AI Chatbot. Ma hai mai sentito parlare di AI Agents? Nel 2025, gli AI Agents stanno cambiando il modo in cui lavoriamo con l’intelligenza artificiale, al punto che Microsoft li definisce le “app dell’era AI”. In questo articolo scoprirai le differenze cruciali tra questi due approcci, quando usare l’uno o l’altro, e i migliori tool da provare subito. Cosa Sono gli AI Chatbot? Gli AI Chatbot sono sistemi di intelligenza artificiale conversazionali con cui interagisci tramite chat. Li conosci già: ...

November 24, 2025 · 7 min · cbor