I campioni utilizzati per la revisione assistita da tecnologia (TAR) contengono campioni di documenti con informazioni personali sensibili. Prima del caricamento sulla piattaforma di revisione, il CPC art. 210 e il GDPR art. 5 impongono la minimizzazione del contenuto. anonym.plus oscura gli elementi personali in locale, preservando la struttura del campione necessaria all'addestramento del modello TAR.
Quando si applica
Un set di training TAR per una causa di responsabilità civile contiene messaggi e-mail con informazioni personali di dipendenti. Tali contenuti vanno oscurati prima del caricamento sulla piattaforma di revisione.
Come lo gestisce anonym.plus
- Carica il set TAR (PDF, EML, DOCX) nell'applicazione locale.
- Il modulo individua gli elementi personali nei documenti campione.
- Nomi, indirizzi e codici identificativi vengono evidenziati.
- Verifica le segnalazioni e conserva le informazioni rilevanti per il training.
- Oscura ogni dato personale non necessario alla classificazione automatica.
- Esporta il campione sanificato pronto per il caricamento sulla piattaforma.
Cosa serve fornire
- Il set di documenti di addestramento (PDF, EML, DOCX o formati strutturati).
- La modalità: oscuramento o sostituzione con etichetta generica.
- Opzionale: una lista delle categorie da trattare.
Tipi di entità rilevati nei documenti legali
| Categoria | Tipo di entità anonym.plus | Esempio |
|---|---|---|
| Persona | PERSON | Valentina Serra → [MITTENTE_1] |
| EMAIL_ADDRESS | v.serra@societasrl.it → [EMAIL] | |
| Data | DATE_TIME | inviato il 12/03/2026 → [DATA] |
| Organizzazione | ORGANIZATION | Società Alfa Srl → [ORG] |
| IP address | IP_ADDRESS | 172.16.0.10 → [IP] |
| Luogo | LOCATION | Ufficio di Napoli → [LUOGO] |
Conformità raggiunta
- Onere della prova e rilevanza — l'art. 2697 c.c. circoscrive la selezione documentale ai fatti che la parte deve provare: il campione di addestramento non giustifica la raccolta di più dati del necessario.
- Sistemi di IA e giustizia — l'Allegato III del Regolamento (UE) 2024/1689 (AI Act) classifica ad alto rischio i sistemi di intelligenza artificiale destinati ad assistere l'autorità giudiziaria, con obblighi di sorveglianza umana.
- Nessuna decisione automatizzata — la classificazione resta uno strumento di supporto: la revisione umana finale è coerente con l'art. 22 GDPR sulle decisioni basate unicamente sul trattamento automatizzato.
- Sicurezza del trattamento — elaborazione interamente offline, nessun upload verso il cloud; le copie di lavoro restano cifrate a riposo con AES-256-GCM + Argon2id, in linea con il GDPR art. 32.
Anonimizza Set di addestramento per revisione assistita offline — vedi piani & inizia gratis →
Limiti & avvertenze
Il set di addestramento deve mantenere caratteristiche statistiche valide per il modello. Un oscuramento eccessivo può ridurre la qualità del campione. Calibra il livello di oscuramento con il responsabile della revisione prima dell'elaborazione.
Domande frequenti
L'oscuramento dei dati personali compromette l'addestramento del modello TAR?
Solo se l'elemento personale è la variabile classificatoria. Negli altri casi, l'oscuramento non altera le caratteristiche rilevanti per il modello.
Posso oscurare selettivamente solo alcune categorie?
Sì. Puoi configurare lo strumento per agire solo su specifiche tipologie di entità.
I documenti del set TAR vengono trasmessi durante l'elaborazione?
No. L'intera operazione è offline.