Salta al contenuto
29 Agosto 2026

Open science: come applicare principi FAIR e scegliere le licenze giuste

Scoprire come i principi FAIR e le licenze corrette rendono i dati scientifici trovabili, riusabili e misurabili nel tempo.

Open science: come applicare principi FAIR e scegliere le licenze giuste

Open science indica un insieme di pratiche che rendono i risultati della ricerca, in particolare i dati accessibili, comprensibili e riutilizzabili. In questo contesto, i principi FAIR e le licenze per i dati scientifici sono strumenti essenziali per condividere informazioni in modo responsabile, strutturato e duraturo. L’obiettivo è permettere a chiunque, con i giusti diritti e tutele, di trovare, accedere, integrare e riusare i dati per generare nuova conoscenza.

La rilevanza di questi principi nasce dalla necessità di evitare dati isolati, documentazione incompleta, restrizioni vaghe o ambigue e riusi impropri. Un set di dati ben descritto, con una licenza chiara e metadati ricchi, contribuisce alla qualità della scienza e alla trasparenza. Questo articolo illustra in modo sistematico i principi FAIR le opzioni di licenza il bilanciamento tra apertura, proprietà intellettuale ed etica, esempi di repository, modalità di citazione e metriche per valutare l’impatto e il riuso.

I principi FAIR: definizioni e applicazione

I principi FAIR (Findable, Accessible, Interoperable, Reusable) sono linee guida per rendere i dati trovabiliaccessibiliinteroperabili e riutilizzabili. Findable richiede metadati accurati e identificatori persistenti, come il DOI. Accessible implica che i dati siano raggiungibili attraverso protocolli standard e che le condizioni di accesso siano esplicitate. Interoperable punta a formati aperti e vocabolari condivisi, per integrare dati tra sistemi diversi. Reusable enfatizza la documentazione dettagliata, la provenienza e una licenza che consenta il riuso dichiarando le condizioni.

Applicare FAIR significa curare tanto il contenuto quanto il contesto. Tipicamente si include un readme strutturato, schede di metadati standard, informazioni sulla raccolta e sul trattamento dei dati, e collegamenti a strumenti o codice utilizzato. L’uso di formati aperti, come CSV per tabelle o TIFF per immagini, evita barriere tecniche e favorisce la interoperabilità. Un dataset FAIR non è soltanto disponibile: è comprensibile e verificabile da terzi.

Licenze per dati scientifici: come scegliere

La licenza stabilisce diritti e doveri di chi riusa i dati. Per i dati fattuali, molte comunità adottano licenze permissive come CC0 (pubblico dominio) o CC BY (attribuzione obbligatoria), che facilitano il riuso e la combinazione con altri dataset. Per database strutturati può essere utile considerare ODC-PDDL o ODC-By pensate per tutele specifiche del database. La scelta dipende dal grado di apertura desiderato, dal contesto disciplinare e dalla presenza di vincoli normativi o contrattuali.

Una buona pratica è rendere la licenza esplicita nel file di metadati e nel repository, con un testo chiaro e un identificatore univoco. È preferibile evitare formulazioni personalizzate o ambigue e optare per licenze standard riconosciute, che riducono incertezza legale e incompatibilità. Dove sono coinvolti dati sensibili o obblighi di riservatezza, si possono adottare modelli di accesso controllato o licenze che limitano specifici usi, mantenendo comunque la trasparenza sulle condizioni.

Apertura, proprietà intellettuale ed etica: bilanciare interessi

Condividere dati significa bilanciare apertura con proprietà intellettuale ed etica. In molte discipline, i dati grezzi sono privi di tutela autoriale, mentre la struttura del database e i materiali di accompagnamento possono essere protetti. È fondamentale distinguere tra i livelli di contenuto e specificare in modo chiaro cosa è coperto dalla licenza. Sul piano etico, la protezione di dati personali, culturali o ecologicamente sensibili richiede anonimizzazione, minimizzazione e regole di accesso proporzionate al rischio.

Un bilanciamento efficace si raggiunge con valutazioni preventive: analisi dei rischi, consultazione di comitati etici, verifiche contrattuali con partner e sponsor, e policy interne che definiscano categorie di dati, tempi di rilascio e condizioni di riuso. Dove l’apertura totale non è possibile, si può ricorrere a embargo temporanei, livelli di accesso differenziati o depositi sicuri con tracciamento degli utenti e accordi d’uso.

Repository affidabili e schemi di citazione corretta

La scelta del repository incide sulla persistenza dell’accesso e sulla visibilità. Repository generalisti come ZenodoDryad e Figshare piattaforme come l’Open Science Framework o archivi istituzionali offrono DOI, metadati standard e integrazione con sistemi di indicizzazione. Per dati disciplinari, archivi dedicati come GenBank o repertori geospaziali garantiscono schemi e vocabolari specifici della comunità.

Citare correttamente un dataset significa includere autore/i titolo, versione identificatore persistente (DOI o equivalente), repository e, quando utile, descrizione del tipo di dati. La citazione deve essere visibile nel testo e nelle riferimenti della pubblicazione, e andrebbe riportata anche nei materiali supplementari. Un file CITATION nel repository, con formati standard (ad esempio BibTeX o ris), facilita il riuso e riduce errori.

Valutare impatto e riuso: metriche e pratiche

L’impatto dei dati si misura con metriche di scoperta e riuso. Tra gli indicatori rilevanti rientrano download visualizzazioni, citazioni del dataset, menzioni in articoli, preprint e report, e utilizzi in software o prodotti derivati. Sistemi di altmetrics possono aggregare segnali da piattaforme accademiche e sociali, mentre l’assegnazione del DOI consente tracciamento stabile. È utile documentare le versioni, i cambiamenti sostanziali e mantenere un changelog pubblico per attribuire correttamente impatti nel tempo.

La misurazione è efficace se supportata da buona curation metadati completi, parole chiave disciplinari, abstract informativi, esempi di utilizzo, e collegamenti a analisi o notebook. La predisposizione di dataset di esempio script per la rielaborazione e test di integrità favorisce riusi riproducibili e aumenta la probabilità di citazione.

Approfondimenti ed eccezioni: dati sensibili, codice e materiali

Esistono casi in cui la piena apertura non è appropriata. Dati personali o culturali delicati richiedono misure di anonimizzazione, accordi di accesso e talvolta restrizioni su geolocalizzazione o granularità. Per dati ecologici o archeologici, limitare coordinate precise può prevenire danni. Il codice associato ai dati beneficia di licenze compatibili, come MIT o GPL tenendo distinta la licenza del codice da quella dei dati per evitare conflitti.

In genere, una strategia robusta prevede la combinazione di FAIR licenze standard, repository affidabili e procedure etiche chiare. Definire responsabilità, tracciare decisioni e comunicare limiti d’uso costruisce fiducia e rende i dati davvero riutilizzabili. Un dataset che esplicita obiettivi, metodi, provenienza e confini del riuso diventa un elemento vivo della letteratura: comprensibile per diversi pubblici, integrabile in molte analisi e capace di generare valore cumulativo senza compromettere diritti e tutele.

Autore

Susanna Riva

Susanna Riva osserva Bologna dalla finestra dell’Archivio di Stato dove una volta ha passato una settimana a consultare faldoni sulle cooperative cittadine: quel documento segnò la scelta editoriale di approfondire responsabilità istituzionali. Tiene linea critica nella redazione, amante del caffè lungo e del taccuino sempre pieno.