Caricare un PDF su un servizio di intelligenza artificiale ormai richiede pochi secondi. Lo si può fare per riassumere un contratto, analizzare un foglio Excel, tradurre un documento o chiedere informazioni su una fotografia. Una volta ottenuta la risposta, però, rimane una domanda meno immediata: che fine fa quel file?
Non esiste una risposta valida per tutte le piattaforme.

Un documento inviato a un servizio AI viene innanzitutto trasferito ai sistemi del fornitore per essere elaborato. Dopo questa fase può essere conservato per un certo periodo, associato alla conversazione o all’account e, in alcune circostanze, i suoi contenuti possono contribuire al miglioramento dei modelli. Tutto dipende dal servizio utilizzato, dal tipo di account e dalle impostazioni scelte dall’utente.
La prima cosa da chiarire è quindi una distinzione spesso trascurata: elaborare un file non significa necessariamente usarlo per addestrare l’intelligenza artificiale.
Caricare un file significa consegnarne una copia al servizio
Quando trasciniamo un documento nella finestra di una AI, il file non rimane soltanto nel nostro computer.
Per poterlo leggere, il servizio deve riceverlo e processarlo sui propri sistemi. A seconda della piattaforma possono essere estratti testo, immagini, metadati o altre informazioni necessarie a rispondere alla richiesta.
Da quel momento entrano in gioco almeno tre processi diversi:
- l’elaborazione necessaria per produrre la risposta;
- la conservazione del file o della conversazione;
- l’eventuale utilizzo dei contenuti per migliorare o addestrare modelli.
Sono aspetti collegati, ma non equivalenti.
Un servizio può, per esempio, conservare temporaneamente un documento senza utilizzarlo per addestrare i propri modelli. Oppure può permettere all’utente di scegliere se le proprie conversazioni contribuiscano al miglioramento dell’AI.
ChatGPT: il file può rimanere salvato nella Libreria
Nel caso di ChatGPT, OpenAI spiega che i file caricati possono essere salvati nella Libreria dell’account quando la funzione è disponibile.
Questo produce una conseguenza poco intuitiva: eliminare la conversazione in cui il documento è stato caricato non significa necessariamente eliminare anche il file dalla Libreria. I due elementi vengono gestiti separatamente.
Se il file viene eliminato definitivamente dalla Libreria, OpenAI indica che la cancellazione dai propri sistemi è programmata entro 30 giorni, salvo alcune eccezioni legate, per esempio, a obblighi legali o esigenze di sicurezza.
C’è poi il tema dell’addestramento.
Per gli account consumer di ChatGPT l’utente può controllare dalle impostazioni se le proprie conversazioni possano contribuire al miglioramento dei modelli. OpenAI mette a disposizione il controllo “Migliora il modello per tutti”, che può essere disattivato.
Esiste inoltre la Chat temporanea. OpenAI dichiara che, finché rimane temporanea, non viene utilizzata per migliorare i modelli; una copia può però essere conservata per un massimo di 30 giorni per ragioni di sicurezza.
Il dettaglio importante è quindi questo: prima di caricare un documento riservato non basta chiedersi se ChatGPT “lo legge”. Conviene controllare che tipo di conversazione si sta usando e quali impostazioni relative ai dati sono attive.
Gemini: conta molto l’impostazione “Salva l’attività”
Anche Google distingue il semplice utilizzo di Gemini dall’impiego dei dati per migliorare i propri servizi.
Nella documentazione dedicata alla privacy delle app Gemini, Google include esplicitamente tra le informazioni condivise dall’utente file, fotografie, video e schermate.
Quando l’impostazione Salva l’attività è attiva, le conversazioni e i contenuti condivisi con Gemini vengono salvati nell’attività dell’utente. Google afferma che tale attività può essere utilizzata per fornire, sviluppare e migliorare i servizi, compreso l’addestramento dei modelli di AI generativa, con il possibile intervento di revisori umani su un sottoinsieme delle interazioni.
Google avverte infatti di non inserire nelle conversazioni informazioni che non si vorrebbe fossero viste o utilizzate secondo queste modalità.
C’è però un’ulteriore distinzione.
Quando Gemini accede a servizi collegati come Gmail, Drive o altre app Workspace, Google afferma che non addestra direttamente i modelli generativi usando, per esempio, l’intera casella Gmail o tutti i file presenti in Drive. Tuttavia, le informazioni derivate dalle interazioni con Gemini possono essere trattate secondo le impostazioni dell’attività.
Ancora una volta, quindi, parlare genericamente di “Google usa i miei file per addestrare Gemini” rischia di essere troppo semplicistico.
E con Claude cosa accade?
Anthropic applica anch’essa regole diverse a seconda del prodotto utilizzato.
Per i servizi consumer come Claude Free, Pro e Max, la documentazione attuale afferma che chat e sessioni possono essere utilizzate per migliorare Claude se l’utente sceglie di consentirlo. Possono esserci inoltre casi legati alle verifiche di sicurezza o ad altri consensi espliciti.
Anthropic specifica inoltre che, quando l’utente autorizza l’utilizzo dei propri dati per migliorare Claude, questi vengono scollegati dall’identificativo dell’utente, come l’indirizzo email, prima dell’utilizzo nei processi di miglioramento dei modelli.
Per i prodotti commerciali, come Claude for Work e l’API, la situazione è differente: Anthropic afferma che, per impostazione predefinita, input e output non vengono utilizzati per addestrare i propri modelli.
È un’altra ragione per cui il nome del servizio, da solo, non basta: un account personale e uno aziendale possono essere sottoposti a condizioni diverse.
Anche Copilot distingue tra tipi di utilizzo
Microsoft presenta ulteriori differenze.
Per i file caricati direttamente in Copilot, la società afferma che un documento o un’immagine condivisi con il servizio possono essere conservati in modo sicuro per un periodo limitato, indicato come non superiore a 18 mesi, prima dell’eliminazione automatica. Le modalità di utilizzo della conversazione dipendono inoltre dalle scelte dell’utente riguardo addestramento e personalizzazione.
Nel caso di Copilot integrato nelle app Microsoft 365 per uso domestico, Microsoft specifica invece che prompt, risposte e contenuto dei file non vengono utilizzati per addestrare i modelli di base.
Anche qui la parola “Copilot” comprende quindi situazioni che non sono necessariamente identiche.
Un file usato per addestrare un modello finisce nella sua “memoria”?
È facile immaginare l’addestramento di una AI come un enorme archivio in cui vengono depositate copie dei documenti caricati dagli utenti. È una rappresentazione troppo semplice.
L’addestramento dei modelli linguistici serve a modificare i parametri del modello affinché riconosca schemi e relazioni nei dati. Non equivale alla normale archiviazione di un PDF in una cartella dalla quale il sistema va successivamente a recuperarlo.
Anthropic, per esempio, spiega esplicitamente che un modello non conserva il testo nello stesso modo di un database e non recupera semplicemente i documenti originali dal proprio insieme di addestramento quando genera una risposta.
Questo non rende irrilevante il problema della privacy. Significa soltanto che “il mio file è conservato sui server” e “il contenuto è stato utilizzato nel processo di addestramento” sono due affermazioni tecnicamente diverse.
Cancellare la chat basta?
Non sempre.
È forse il punto più pratico da ricordare.
Su ChatGPT, ad esempio, un file salvato nella Libreria può sopravvivere alla cancellazione della conversazione e deve essere eliminato separatamente.
Altri servizi prevedono proprie finestre di conservazione, sistemi di cronologia e controlli differenti.
Prima di considerare realmente rimosso un documento conviene quindi controllare almeno tre cose:
- se esiste una sezione dedicata ai file caricati;
- se la cancellazione della chat elimina anche gli allegati;
- quale periodo di conservazione dichiara il fornitore dopo la richiesta di eliminazione.
Quali file sarebbe meglio non caricare con leggerezza
Una AI può essere molto utile per leggere documenti, ma la comodità non dovrebbe far dimenticare cosa contiene il file.
Un PDF apparentemente innocuo può includere nomi, indirizzi, firme, numeri di telefono, dati bancari, informazioni sanitarie o dati relativi ad altre persone.
Lo stesso vale per documenti aziendali, contratti non pubblici, database di clienti, credenziali, codici sorgente riservati o materiale coperto da accordi di confidenzialità.
In questi casi la domanda non dovrebbe essere soltanto “l’AI è in grado di analizzarlo?”, ma anche “sono autorizzato a inviare queste informazioni a questo servizio?”
Per documenti particolarmente delicati può essere preferibile rimuovere prima i dati non necessari, anonimizzare nomi e identificativi oppure utilizzare strumenti e account aziendali che prevedano condizioni specifiche sul trattamento dei dati.
Le impostazioni sulla privacy meritano più attenzione del pulsante “Carica”
Il comportamento dei servizi di intelligenza artificiale cambia nel tempo, e le stesse aziende modificano periodicamente funzioni, impostazioni e politiche di conservazione.
Per questo non esiste una regola universale del tipo “i file caricati sulle AI vengono usati per addestrarle”, così come non sarebbe corretto affermare che “vengono cancellati appena termina la conversazione”.
La regola pratica più utile è un’altra: prima di inviare informazioni che non pubblicheremmo liberamente online, controllare le impostazioni del servizio, la sua policy sui dati e il tipo di account utilizzato.
Il caricamento dura pochi secondi. Il trattamento del documento, invece, può continuare anche dopo che sullo schermo è già comparsa la risposta.
DOMANDE FREQUENTI
I file caricati su un’AI vengono sempre usati per addestrarla?
No. Dipende dal servizio, dal prodotto, dal tipo di account e dalle impostazioni dell’utente. Alcuni servizi consentono di escludere le conversazioni dal miglioramento dei modelli, mentre per determinati prodotti aziendali l’addestramento sui dati del cliente è escluso per impostazione predefinita.
Eliminando una conversazione viene eliminato anche il file?
Non necessariamente. In ChatGPT, per esempio, i file salvati nella Libreria vengono gestiti separatamente dalla chat e devono essere eliminati dalla Libreria stessa.
È sicuro caricare documenti riservati su un servizio AI?
Dipende dal contenuto e dalle condizioni del servizio. Prima di caricare dati personali, sanitari, finanziari, aziendali o appartenenti a terzi è opportuno controllare policy, impostazioni di conservazione e autorizzazioni all’utilizzo di quei dati.
Una chat temporanea impedisce l’addestramento?
Nel caso di ChatGPT, OpenAI dichiara che le chat temporanee non vengono utilizzate per migliorare i modelli finché rimangono temporanee. Una copia può comunque essere conservata fino a 30 giorni per motivi di sicurezza.
FONTI
- OpenAI Help Center — Politiche di mantenimento delle chat e dei file su ChatGPT
https://help.openai.com/it-it/articles/8983778-politiche-di-mantenimento-delle-chat-e-dei-file-su-chatgpt - OpenAI Help Center — Archiviazione dei file e Libreria in ChatGPT
https://help.openai.com/it-it/articles/20001052-file-storage-and-library-in-chatgpt - OpenAI Help Center — FAQ sui controlli dei dati
https://help.openai.com/it-it/articles/7730893-data-controls-in-chatgpt - OpenAI Help Center — Chat temporanea in ChatGPT
https://help.openai.com/it-it/articles/8914046-temporary-chat-in-chatgpt - Google — Centro per la privacy delle app Gemini
https://support.google.com/gemini/answer/13594961?hl=it - Google — Informazioni sulla personalizzazione con le App connesse
https://support.google.com/gemini/answer/16836988?hl=it - Anthropic Privacy Center — Is my data used for model training?
https://privacy.anthropic.com/en/articles/10023580-is-my-data-used-for-model-training - Anthropic Privacy Center — How Do You Use Personal Data in Model Training?
https://privacy.anthropic.com/en/articles/10023555-how-do-you-use-personal-data-in-model-training - Microsoft Support — Domande frequenti sulla privacy per Microsoft Copilot
https://support.microsoft.com/it-it/microsoft-copilot/privacy-faq-for-microsoft-copilot - Microsoft Support — Copilot in Microsoft 365 Apps per utenti privati: dati e privacy
https://support.microsoft.com/it-it/privacy/copilot-in-microsoft-365-apps-for-home-your-data-and-privacy
Continua a scoprire curiosità, misteri, tecnologia e storie sorprendenti anche dall'app Veb.
Scarica gratis per Android






