Fine-tuning vs RAG per PMI italiane: quando personalizzare un modello AI e quando usare i propri documenti
Per il 90% delle PMI italiane il RAG è la scelta giusta: più economico, aggiornabile senza re-training e verificabile perché cita sempre la fonte.
Il fine-tuning AI serve in pochissimi casi specifici — per la maggior parte delle PMI italiane è un investimento sproporzionato. Se vuoi che il tuo assistente AI risponda usando le procedure aziendali, i listini e i prodotti della tua azienda, la tecnologia giusta si chiama RAG (Retrieval-Augmented Generation): costa meno, si aggiorna in ore invece che in settimane, e cita sempre la fonte da cui ha estratto la risposta.
Questo articolo non è per sviluppatori. È per imprenditori, responsabili IT e commerciali che vogliono capire quale approccio scegliere senza affidarsi ciecamente a un consulente.
Cosa significa davvero "personalizzare" un modello AI
Quando dici "voglio un AI che conosca la mia azienda", stai descrivendo due cose molto diverse:
- Vuoi che l'AI risponda usando i tuoi documenti (procedure operative, listini, FAQ, contratti, schede prodotto). In questo caso serve il RAG.
- Vuoi che l'AI scriva o parli esattamente come scrivi tu (gergo proprietario, formato di offerta specifico, tono riconoscibile). In questo caso potrebbe servire il fine-tuning.
La confusione tra i due approcci è la causa principale di progetti AI che costano molto e deludono.
RAG: cos'è e come funziona in pratica
RAG è una tecnica che permette a un modello AI di cercare nei tuoi documenti prima di rispondere. Quando un dipendente scrive "quali sono i termini di reso per i clienti B2B?", l'AI non inventa una risposta: va a cercare nel tuo archivio, trova il contratto o la procedura giusta, e risponde citando la fonte.
Il funzionamento tecnico, spiegato senza gergo: ogni tuo documento viene convertito in un "vettore" numerico (una rappresentazione matematica del significato del testo). Quando arriva una domanda, l'AI la cerca semanticamente tra tutti questi vettori, trova i passaggi più pertinenti, e li usa come contesto per formulare la risposta.
Cosa cambia rispetto a un chatbot normale: un chatbot generico può inventare risposte plausibili ma sbagliate (le cosiddette "allucinazioni"). Un sistema RAG ben configurato risponde solo basandosi sui documenti che gli hai dato — e quando non trova nulla, lo dice.
Costi reali nel 2026: una knowledge base RAG per una PMI con 500-2.000 documenti costa tra 10.000 e 30.000 € in fase di sviluppo e tra 500 e 2.000 €/mese di gestione corrente (tra piattaforma vettoriale, API LLM e manutenzione). Per volumi più piccoli, soluzioni SaaS come Notion AI, Microsoft Copilot for SharePoint o Guru partono da 20-80 €/mese per utente senza sviluppo personalizzato.
Fine-tuning: quando ha davvero senso (e quando no)
Il fine-tuning consiste nell'addestrare ulteriormente un modello AI già esistente su un dataset di esempi specifici. In pratica, mostri al modello migliaia di coppie "input-output" che rappresentano il comportamento che vuoi ottenere, e il modello aggiorna i suoi parametri per replicarlo.
Costi reali nel 2026: il fine-tuning di GPT-4o su OpenAI costa circa 25$/milione di token in fase di training, più 3,75$/milione di token in input e 15$/milione in output a inferenza. Poiché il training si ripete per ogni epoca, un dataset da 1 milione di token addestrato per 3 epoche costa circa 75$ di soli costi computazionali — ma il costo reale include la preparazione del dataset, i test, e i successivi re-training quando cambiano le esigenze. Su Google Vertex AI le cifre sono comparabili; Anthropic al momento non offre un servizio di fine-tuning self-service per Claude.
Tre casi in cui il fine-tuning ha senso per una PMI:
- Stile di scrittura molto preciso e proprietario — un'azienda con contratti tecnici in un gergo settoriale strettissimo (es. automazione industriale, farmaceutica) che deve generare decine di documenti al giorno in un formato standard rigoroso.
- Migliaia di esempi classificati disponibili — un call center con 50.000 conversazioni etichettate (motivo contatto + risposta corretta) che vuole un modello addestrato sulle sue risposte storiche migliori.
- Latenza critica ad alto volume — sistemi embedded dove ogni millisecondo conta e il RAG aggiunge troppa latenza (raro nelle PMI).
Fuori da questi tre scenari, il fine-tuning quasi sempre delude le aspettative, perché non impara fatti nuovi — impara pattern stilistici. Se vuoi che l'AI sappia che il tuo listino è cambiato questa settimana, il fine-tuning non aiuta: bisogna riaddestrare. Il RAG invece si aggiorna caricando il nuovo documento.
Tabella comparativa: RAG vs Fine-tuning per PMI
| Criterio | RAG | Fine-tuning |
|---|---|---|
| Casi d'uso ideali | Knowledge base, FAQ, procedure, supporto clienti | Stile scrittura specifico, classificazione con molti esempi |
| Aggiornamento dei contenuti | Immediato (ricarica il documento) | Richiede re-training (settimane, costo aggiuntivo) |
| Costo di setup | 10.000–30.000 € (custom) o 20-80 €/utente/mese (SaaS) | 15.000–100.000 €+ |
| Costo operativo mensile | 500–2.000 €/mese per PMI media | Costi inferenza più alti + manutenzione dataset |
| Cita le fonti | Sì — risponde con riferimento al documento | No — risposta integrata senza tracciabilità |
| Rischio di allucinazione | Basso se la documentazione è coerente | Presente, dipende dalla qualità del dataset |
| Requisiti tecnici minimi | Medio (connessione documenti + LLM) | Alto (data engineering + MLOps) |
| Tempo per andare live | 4–10 settimane | 9–24 settimane |
| GDPR con dati sensibili | Gestibile anche on-premise | Dati inviati al cloud del provider per il training |
Il fattore GDPR: perché per le PMI italiane conta più del costo
Questo è l'aspetto più trascurato nelle guide tecniche sul fine-tuning.
Per addestrare un modello su OpenAI o Google Vertex AI, devi inviare i tuoi dati ai server di questi provider. Per la maggior parte dei dati aziendali operativi questo non è un problema — la maggior parte dei contratti cloud prevede clausole Data Processing Agreement (DPA) conformi al GDPR. Ma diventa un problema serio se nel dataset ci sono:
- Dati personali di clienti (nomi, email, dati di acquisto) — richiedono base legale per il trattamento in training
- Dati personali di dipendenti (valutazioni, comunicazioni interne) — richiedono verifica ai sensi dell'art. 4 Statuto dei Lavoratori
- Informazioni commerciali riservate (listini interni, margini, accordi contrattuali) — non è un problema GDPR, ma di riservatezza commerciale
Il RAG su infrastruttura interna (server aziendali o cloud europeo con data residency garantita) evita questi problemi: i documenti non escono dall'azienda, vengono solo indicizzati localmente.
La multa da 15 milioni di euro inflitta dal Garante a OpenAI a fine 2024 per uso non conforme di dati italiani ha reso le PMI italiane molto più attente a dove finiscono i propri dati. Prima di avviare qualsiasi progetto di fine-tuning, è prudente verificare con il proprio DPO (o consulente privacy) se i dati del dataset sono trattabili per questo scopo.
Caso concreto: un'azienda manifatturiera da 30 dipendenti
Un'azienda metalmeccanica nel distretto bresciano produce componenti su specifica per l'automotive. Ha 800 procedure tecniche, 200 schede prodotto e un archivio di preventivi degli ultimi 5 anni.
Obiettivo: i tecnici vogliono trovare rapidamente la procedura corretta senza chiamare il capoofficina, e il commerciale vuole generare preventivi nuovi partendo da quelli storici simili.
Perché il RAG è la scelta giusta:
- Il contenuto cambia spesso (nuove procedure, aggiornamenti schede)
- I dati includono dati tecnici proprietari da non inviare a OpenAI
- Serve tracciabilità: il tecnico deve sapere da quale documento viene la risposta
- Budget disponibile: 1.500 €/mese
Risultato implementazione: dopo 6 settimane con una soluzione RAG su Microsoft Copilot for SharePoint (documenti già su SharePoint), ogni tecnico trova la risposta corretta in 10 secondi. I preventivi nuovi vengono generati in 20 minuti invece di 2 ore.
Perché il fine-tuning sarebbe stato sbagliato:
- Le procedure si aggiornano ogni mese — il re-training avrebbe richiesto settimane ogni volta
- Il dataset non era abbastanza grande (800 documenti, non 50.000 esempi)
- Costo sproporzionato rispetto all'obiettivo
Checklist decisionale in 5 domande
Prima di scegliere tra RAG e fine-tuning, rispondi a queste domande:
1. Vuoi che l'AI risponda usando informazioni specifiche della tua azienda? → Sì: parti dal RAG.
2. I tuoi contenuti cambiano spesso (listini, procedure, normative)? → Sì: il fine-tuning è inadatto — ogni aggiornamento richiede re-training.
3. Hai almeno 10.000 esempi etichettati di coppie input-output? → No: il fine-tuning probabilmente non migliorerà i risultati in modo significativo.
4. Hai bisogno che l'AI replichi uno stile di scrittura molto specifico (non solo il contenuto)? → Sì: il fine-tuning può valere la pena, ma solo dopo aver esaurito le opzioni di prompting avanzato.
5. Il dataset contiene dati personali di dipendenti o clienti? → Sì: il fine-tuning su cloud estero richiede una valutazione GDPR approfondita prima di procedere.
Se hai risposto "no" a domanda 3 e "sì" a domanda 1, 2 o 5, il RAG è quasi certamente la scelta corretta.
Come iniziare senza un team tecnico interno
Per una PMI senza sviluppatori interni, il percorso più rapido:
- Verifica se hai già una piattaforma documentale (SharePoint, Google Drive, Notion). Molte integrano già funzionalità RAG di base nella licenza esistente.
- Identifica le 20 domande più frequenti che dipendenti o clienti fanno ogni settimana. Queste guidano la prima indicizzazione.
- Inizia con 50-100 documenti, non con l'archivio completo — un RAG ben fatto su un sottoinsieme piccolo funziona meglio di un RAG mal configurato su tutto.
- Misura la qualità delle risposte nelle prime 4 settimane e aggiusta la configurazione prima di allargare.
Il servizio di audit AI infrastructure di Rayo Consulting include una valutazione dell'approccio più adatto (RAG, fine-tuning o semplice prompting avanzato) per la tua situazione specifica, con una stima dei costi e dei tempi di implementazione basata sui tuoi dati reali.
FAQ
Cos'è il fine-tuning AI e quando conviene a una PMI italiana? Il fine-tuning è l'addestramento aggiuntivo di un modello AI su esempi specifici della propria azienda. Conviene solo quando si hanno migliaia di esempi etichettati disponibili, quando si vuole replicare uno stile di scrittura molto preciso, o quando la latenza è critica. Per la maggior parte delle PMI italiane, il RAG offre risultati migliori a costi inferiori.
Qual è la differenza concreta tra RAG e fine-tuning? Il RAG recupera le risposte dai tuoi documenti al momento della domanda — come un motore di ricerca interno intelligente. Il fine-tuning modifica permanentemente il comportamento del modello attraverso l'addestramento. Il RAG è aggiornabile in ore; il fine-tuning richiede settimane e costi aggiuntivi a ogni modifica.
Il fine-tuning è sicuro per i dati aziendali sensibili? Dipende dall'implementazione. Se il fine-tuning viene eseguito su cloud di provider terzi (OpenAI, Google), i dati del dataset vengono inviati ai loro server. Per dati sensibili (clienti, dati commerciali riservati, informazioni personali dipendenti), va verificata la conformità GDPR con il proprio DPO prima di procedere. Il RAG on-premise evita questo problema.
Quanto costa implementare un sistema RAG per una PMI italiana nel 2026? Dipende dalla complessità. Soluzioni SaaS integrate (Notion AI, Copilot for SharePoint) costano 20-80 €/utente/mese senza sviluppo. Una soluzione RAG custom su misura per una PMI con 500-2.000 documenti richiede un investimento di 10.000-30.000 € e 500-2.000 €/mese di gestione.
Serve uno sviluppatore per implementare il RAG in azienda? Non necessariamente. Se la PMI usa già Microsoft 365 o Google Workspace, le funzionalità RAG native (Copilot for SharePoint, NotebookLM for Business) si configurano senza sviluppo. Per integrazioni più complesse su sistemi gestionali italiani o fonti dati multiple, serve un consulente tecnico, ma non un team interno dedicato.