Skip to content

IA locale: costruisci la tua suite LLM in locale con Ollama

Esegui un LLM in locale nel 2026: hardware realistico, Ollama e LM Studio, i modelli open giusti, RAG locale e il tuo primo agente.

Far girare un modello linguistico serio sulla propria macchina, a metà 2026, richiede un pomeriggio, uno strumento gratuito e un computer con almeno 8 GB di memoria. Niente account, niente chiave API, nessun dato che lascia la tua scrivania. I modelli scaricabili oggi (Qwen3.5, Gemma 4, gpt-oss di OpenAI, Mistral Small) valgono più o meno quanto valeva il top a pagamento diciotto mesi fa: più che sufficiente per riassumere, scrivere bozze, estrarre dati, tradurre e interrogare documenti interni. Questo è un tutorial, non un manifesto. Ti dico esattamente in quale fascia di hardware ti trovi, quale delle due porte d'ingresso scegliere (Ollama o LM Studio), quali modelli entrano davvero nella tua RAM, come chiamare il tutto da uno script, come dargli i tuoi documenti e come trasformarlo in un primo piccolo agente. Ti dico anche, senza giri di parole, dove l'IA locale perde ancora contro le API di frontiera, perché…