ChatGPT legge le nostre conversazioni?

Un’inchiesta di 404 Media racconta cosa succede dietro le quinte di “Project Lily”, un progetto interno di OpenAI nel quale centinaia di collaboratori umani leggono alcune conversazioni reali degli utenti per migliorare le risposte di ChatGPT.

Il loro lavoro consiste nel capire cosa stava chiedendo l’utente, confrontare diverse risposte generate dal modello e valutarle.

Devono segnalare, per esempio, risposte troppo compiacenti, il classico AI-speak, l’abuso di emoji oppure frasi in cui il modello finge esperienze umane del tipo «so cosa significa» o «da chef, preferisco…».

I reviewer non vedono il nome dell’account e OpenAI applica un filtro per eliminare le informazioni personali. Il problema è che nessun filtro è perfetto. Secondo quanto riportato, in alcuni casi i reviewer possono vedere anche una sintesi delle memorie dell’utente, che può contenere elementi sul lavoro, sulla vita personale o sulla posizione geografica.

Questo non significa che qualcuno legga tutte le nostre chat. Significa però che dovremmo smettere di considerare un chatbot come un diario segreto.

Possiamo ridurre parecchio il rischio con alcune semplici accortezze.

  • Disattivare “Improve the model for everyone”. In Settings → Data Controls possiamo mettere su Off questa opzione. Da quel momento le nuove conversazioni non vengono utilizzate per addestrare i modelli. L’impostazione, però, non agisce retroattivamente.
  • Usare Temporary Chat per le conversazioni più sensibili. Le chat temporanee non entrano nella cronologia, non creano memorie e non vengono utilizzate per addestrare i modelli. OpenAI le conserva comunque fino a 30 giorni per motivi di sicurezza.
  • Disattivare la Memory se non ci serve. Più ChatGPT ricorda di noi, più informazioni personali possono entrare nel contesto delle conversazioni. Disattivarla impedisce la creazione e l’utilizzo di nuove memorie. Se vogliamo eliminare informazioni già memorizzate, spegnere la funzione da sola non basta. Bisogna intervenire anche sulle memorie e sulle chat che contengono quei dati.
  • Per dati aziendali sensibili, usare un piano Business o Enterprise. Qui c’è una distinzione importante. Pagare ChatGPT Plus o Pro non significa automaticamente avere maggiore privacy rispetto al training. Nei piani Business, Enterprise ed Edu, invece, OpenAI dichiara di non utilizzare input e output per addestrare i modelli per impostazione predefinita.

E naturalmente rimane la regola più semplice. Nomi, password, dati sanitari, documenti riservati, informazioni sui clienti e segreti aziendali andrebbero condivisi solo quando sono davvero necessari e, quando possibile, anonimizzati prima.