Lo so: ChatGPT, Claude e Gemini sono fantastici. Ma per un blog personale a volte servono risposte più veloci, senza limiti di token, e soprattutto senza condividere i tuoi contenuti con server esterni (pensa agli articoli non ancora pubblicati). Inoltre, se il tuo blog ha un traffico basso o vuoi sperimentare con modelli diversi, un’AI locale è la soluzione ideale.
Ollama è il software open source che rende tutto questo semplice, anche per chi non è un esperto di machine learning.
Ollama è un tool gratuito e libero (licenza MIT) che ti permette di scaricare, eseguire e gestire modelli di linguaggio di grandi dimensioni (LLM) direttamente sul tuo computer. Non serve connessione a Internet una volta scaricato il modello.
Puoi usarlo:
- via terminale (da riga di comando)
- via API HTTP (per integrarlo in applicazioni web o script)
- con interfacce grafiche come Open WebUI (molto comoda, tipo ChatGPT locale)
Supporta modelli famosi come Llama 3 (Meta), Mistral, Gemma (Google), Phi-3 (Microsoft) e molti altri. Alcuni sono così piccoli che girano su un laptop senza GPU dedicata.
Con Ollama puoi:
- Generare bozze di articoli (es. “Scrivi un articolo di 500 parole su come coltivare basilico in casa”)
- Riassumere testi lunghi (utile per citazioni o estratti)
- Riscrivere frasi (cambia tono, correggi grammatica)
- Tradurre contenuti in più lingue
- Creare meta description e titoli SEO
- Rispondere a commenti del blog (se integri un’interfaccia)
Tutto senza limiti di richieste al giorno e senza costi di API.
💻 Come installarlo
Su macOS (Intel o Apple Silicon)
# Con Homebrew
brew install ollama
# Oppure scarica il pacchetto da ollama.com
Su Linux
curl -fsSL https://ollama.com/install.sh | sh
Su Windows
Ollama ha supporto nativo dalla versione 0.1.33 – scarica l’installer .exe da ollama.com/download.
Oppure usa WSL2 se preferisci l’ambiente Linux.
Dopo l’installazione, apri il terminale (o PowerShell) e digita:
# Scarica ed esegue Llama 3 (8B, ~4.7 GB)
ollama run llama3
Dopo il download, entri in una chat interattiva. Scrivi il tuo prompt e premi Invio.
Esempio:
> Scrivi una breve introduzione per un articolo su come fare il pane in casa
Risposta (modello Llama 3):
“Fare il pane in casa è un’arte antica che regala profumi e sapori unici. Non servono attrezzature speciali: con farina, acqua, lievito e un po’ di pazienza puoi ottenere un pane fragrante...”
Vuoi usarlo da programma? Attiva il server API:
ollama serve
Poi, da qualsiasi applicazione (PHP, Python, Node.js…), puoi fare una richiesta HTTP:
import requests
response = requests.post('http://localhost:11434/api/generate',
json={'model': 'llama3', 'prompt': 'Spiega cos\'è un prompt in 3 righe'})
print(response.json()['response'])
Facile, vero?
Integrarlo nel tuo blog (es. Drupal, WordPress, Jekyll, Ghost)
Puoi creare un plugin personalizzato o un bot di backend che riceve richieste dal pannello di amministrazione e restituisce testo generato da Ollama. Ad esempio:
- WordPress: un plugin che aggiunge un pulsante “AI Write” nell’editor.
- Static site generator: uno script che genera bozze in Markdown.
Oppure usare Open WebUI (estensione gratuita di Ollama) per avere una chat bella e pronta, da lasciare anche ai visitatori del blog (se hai risorse). Richiede:
- Spazio su disco: un modello di medie dimensioni (7-8 miliardi di parametri) occupa circa 4-5 GB.
- RAM/VRAM: su CPU serve almeno 8 GB di RAM; su GPU (NVIDIA o AMD) è molto più veloce.
- Qualità: i modelli locali non sono ancora al livello di GPT-4, ma per scrivere bozze, riformulare e generare idee sono più che sufficienti.
- Privacy: tutto rimane sul tuo PC. Nessun dato esce.
Se non hai mai usato un AI locale, provalo con il modello Phi-3-mini (3.8B, circa 2 GB) – è piccolo, veloce e perfetto per test:
ollama run phi3
Poi chiedigli: “Scrivi un tweet promozionale del mio sito”.
Ollama è il modo più semplice per portare l’AI sul tuo computer e usarla per il tuo blog. È gratuito, rispetta la tua privacy e ti dà il pieno controllo.