Anonimizzazione o pseudonimizzazione: la differenza per i documenti
«Ho anonimizzato, ho tolto i nomi»: è quasi sempre falso. Pseudonimizzare, anonimizzare o tenere il testo su un modello confidenziale: il confronto, e quando scegliere cosa.
«Ho anonimizzato, ho tolto i nomi»: è quasi sempre falso. Pseudonimizzare, anonimizzare o tenere il testo su un modello confidenziale: il confronto, e quando scegliere cosa.
«Tutto a posto, ho anonimizzato il fascicolo: ho tolto i nomi.» È una frase che si sente in ogni ufficio, poco prima che un documento finisca in un'IA di largo consumo. Ed è quasi sempre falsa: togliere i nomi significa, nel migliore dei casi, pseudonimizzare. E questa differenza decide che cosa resta un dato personale.
Pseudonimizzare significa sostituire ciò che identifica direttamente una persona (un nome, un indirizzo, un numero di pratica) con un segnaposto: «la signora Martini» diventa [CLIENTE A]. Una tabella di corrispondenza permette di reinserire i nomi reali nel risultato.
Anonimizzare significa rendere la persona impossibile da riconoscere, per chiunque, anche incrociando altre informazioni. Non esiste più alcuna tabella, e cancellare i nomi non basta: bisogna neutralizzare anche ciò che permette di riconoscere qualcuno. Una data di nascita, una funzione rara, un piccolo comune, una sequenza di datori di lavoro: ogni dettaglio sembra innocuo, ma messi insieme indicano una sola persona.
Il test è semplice: qualcuno che conosce l'ambiente saprebbe dire di chi si tratta? Se sì, il documento non è anonimo, per quanti nomi siano stati tolti.
Il GDPR non lascia dubbi: i dati pseudonimizzati restano dati personali. Solo i dati davvero anonimi escono dal suo campo di applicazione. La legge federale svizzera sulla protezione dei dati (LPD) segue la stessa logica: si applica non appena una persona è identificabile, non solo quando è nominata.
Un documento ripulito dai nomi e poi inviato a un servizio esterno resta quindi una comunicazione di dati personali a terzi. E per una professione tenuta al segreto, è il contenuto del fascicolo a essere protetto, non solo l'identità del cliente.
| Inviare così com'è | Pseudonimizzare | Anonimizzare | Tenere su un modello confidenziale | |
|---|---|---|---|---|
| Cosa esce | Tutto | Il testo, con i nomi sostituiti da segnaposto | Un testo in cui nessuno è riconoscibile | Nulla verso terzi |
| Cosa resta a voi | Nulla | La tabella di corrispondenza | Nulla da ripristinare | L'intero testo |
| Natura dei dati | Personali | Sempre personali | Fuori campo, se l'anonimato regge davvero | Personali, trattati in un quadro scelto |
| Chi decide | Nessuno | Voi, segnaposto per segnaposto | Voi, fino al minimo dettaglio di contesto | Voi, scegliendo il modello |
| Sforzo | Nullo | Basso se se ne occupa lo strumento | Elevato | Nullo |
| Risposta ottenuta | Completa ma esposta | Completa, con i nomi ripristinati | Spesso generica | Completa |
La pseudonimizzazione è adatta quando l'identità non serve, ma il resto del testo conta: riformulare una lettera, correggere il tono di un'e-mail, riassumere un contratto tipo. L'IA lavora su [CLIENTE A], e voi ritrovate la signora Martini nella risposta.
L'anonimizzazione serve quando il testo deve circolare senza di voi: un caso di studio per una formazione, un esempio in una presentazione. Richiede lavoro, e spesso il testo perde proprio ciò che lo rendeva utile.
Il modello confidenziale si impone quando il contesto basta da solo a identificare qualcuno: un curriculum, un documento d'identità, una cartella clinica, un caso noto in una piccola città. Mascherare il nome di un candidato trasmettendo però tutta la sua carriera non protegge nulla; è il caso trattato nella nostra guida sulla sintesi dei curriculum.
Per impostazione predefinita, IA Confidential elabora le vostre domande con modelli confidenziali: modelli aperti installati su server in Svizzera, che non trasmettono nulla a terzi. Non c'è bisogno di mascherare il testo.
Se scegliete un modello esterno, il Filtro di riservatezza rileva prima i dati sensibili nel vostro messaggio. Vi propone di rispondere con un modello confidenziale, con il messaggio intatto, oppure di anonimizzarlo per il modello esterno: rileggete e correggete la versione proposta prima dell'invio. L'invio così com'è resta una vostra decisione.
Gli allegati (testo, PDF, Word, immagini) vengono letti nel vostro browser. Verso un modello esterno partono solo gli estratti utili, pseudonimizzati: i nomi diventano segnaposto, la tabella di corrispondenza non viene mai trasmessa e i nomi reali ricompaiono nella risposta che leggete. Quando un documento resta identificativo anche dopo il mascheramento, l'assistente lo segnala come «Documento identificativo»: viene allora elaborato da un modello confidenziale, oppure parte solo la vostra domanda.
Nessun rilevatore può indovinare il nome in codice di un progetto o il soprannome di un cliente. Nel pannello Riservatezza, le vostre istruzioni di anonimizzazione indicano ciò che va sempre mascherato, per esempio:
Sostituisci il nome del mio studio con [STUDIO] e quelli dei miei clienti con [CLIENTE A], [CLIENTE B], nell'ordine in cui compaiono. Maschera anche i numeri di pratica, i nomi delle vie e il nome in codice del progetto «Atlas».
Questi strumenti rilevano, ma non conoscono il vostro mestiere: rileggete la versione proposta. L'IA può anche sbagliare o inventare; ciò che esce con il vostro nome resta una vostra responsabilità. Per ciò che non dovrebbe mai partire, nemmeno mascherato, consultate i dati da non incollare mai in un'IA.
Con un modello confidenziale, il vostro testo e i vostri allegati sono elaborati su server situati in Svizzera, nel quadro della legge svizzera sulla protezione dei dati (LPD), fuori dalla portata del CLOUD Act, e da parte nostra non viene conservato nulla: la cronologia resta nel vostro browser.
Verso un modello esterno, nulla parte senza passare dal filtro: la versione anonimizzata che avete riletto, estratti pseudonimizzati, oppure il messaggio così com'è, se lo avete deciso voi. La tabella di corrispondenza dei segnaposto resta con la conversazione, nel vostro browser.
Su una postazione condivisa, questa conversazione è leggibile da chiunque usi la stessa sessione: disconnettetevi quando ve ne andate.
Per le abitudini di base, leggete anche la nostra guida per usare l'IA al lavoro senza rischi. E per vedere il filtro all'opera su un testo fittizio: aprite la chat.