Edizione del

By

Nei precedenti articoli di questa serie, ho presentato quattro sfide comuni che incontro frequentemente nei progetti di integrazione geospaziale. Dopo aver approfondito l'importanza di conoscere i propri dati nel post precedente, ora passo alla seconda sfida: la creazione di metadati basati su standard.

In uno dei miei progetti precedenti, quando ho chiesto ai colleghi se avessero metadati, molti hanno risposto "sì". Tuttavia, ho presto scoperto che questi "metadati" erano file in formati ad hoc, contenenti solo metadati di individuazione, oppure output generati da software con statistiche sul file o sul modello sottostante.

Nel campo geospaziale, in genere le persone hanno maggiore familiarità con il concetto di metadati basati su standard – metadati che seguono standard consolidati come ISO 19115, INSPIRE, Dublin Core o DCAT – rispetto a molte altre discipline scientifiche.

I metadati sono un elemento fondamentale dei principi FAIR , in quanto contribuiscono a rendere i set di dati reperibili e accessibili. Tuttavia, se i metadati non rispettano uno standard, non sono né interoperabili né riutilizzabili.

Perché i metadati basati su standard sono importanti

La creazione di metadati basati su standard, tuttavia, sembra ancora essere un compito arduo per molte persone. Ciò potrebbe essere dovuto alla mancanza di strumenti che supportino la creazione di metadati, unita alla percezione che i metadati stessi siano complicati.

Inoltre, non aiuta il fatto che molte persone non considerino i metadati particolarmente utili, il che le rende poco motivate a investire tempo nella loro creazione.

Credo che la scelta dello schema di metadati corretto sia di fondamentale importanza. Esiste un punto di equilibrio tra la creazione di qualcosa di utile per il progetto e il non sovraccaricare gli utenti con troppi campi da compilare.

In alcuni casi, i soli metadati di scoperta potrebbero essere sufficienti, ad esempio pochi campi come nell'unità atomica dei record dell'API OGC . In altri casi, dovrebbe essere possibile estrarre automaticamente alcune informazioni, lasciando agli utenti il ​​compito di compilare solo pochi campi.

L'obiettivo dovrebbe essere quello di richiedere il minor intervento manuale possibile, garantendo al contempo che le informazioni fornite siano accurate e significative.

Dopotutto, l'unica cosa peggiore dell'assenza totale di metadati è avere metadati di scarsa qualità . Quando un sistema acquisisce metadati di bassa qualità, non riesce a fornire informazioni utili, rafforzando la percezione che i metadati stessi abbiano scarso valore.

Semplificare la creazione dei metadati

Purtroppo, l'ecosistema di strumenti per la creazione e la visualizzazione dei metadati non è ancora così "ricco" come l'ecosistema dei dati: una lacuna che credo dovremmo colmare.

Tuttavia, possiamo comunque aiutare gli utenti a creare facilmente metadati basati su standard, evitando flussi di lavoro che richiedono l'invio diretto di file XML o JSON.

Un approccio pratico consiste nel fornire un modulo di sondaggio e porre agli utenti alcune domande sui dati, specificando chiaramente che devono compilare un sondaggio per ogni nuovo set di dati.

Quando gli utenti gestiscono numerosi set di dati con informazioni ripetitive, un foglio di calcolo può risultare più efficiente, consentendo di copiare e incollare le informazioni tra più record. Un processo ETL può quindi convalidare queste risposte, trasformarle in metadati leggibili dalla macchina e infine importarle nel sistema.

Flusso di lavoro per l'invio dei metadati per il progetto eMOTIONAL Cities

Il progetto eMOTIONAL Cities ha offerto agli utenti diversi modi per inviare metadati all'infrastruttura di dati spaziali (SDI), che spaziavano da interfacce intuitive per gli esseri umani, come i moduli di sondaggio, ad approcci più adatti alle macchine (ad esempio, richieste POST).

Cambiare la percezione dei metadati

Sebbene possiamo, e dovremmo, aumentare il numero di client per i metadati e creare flussi di lavoro che aiutino gli utenti a creare metadati con gli strumenti esistenti, la percezione dei metadati come "irrilevanti" rimarrà un ostacolo alla loro diffusione.

Come vediamo con i dati stessi, le persone sono disposte a dedicare una notevole quantità di tempo e impegno alla produzione di risultati di alta qualità. Dobbiamo promuovere la stessa mentalità per i metadati e, per esperienza, ciò può avvenire solo attraverso la formazione e la divulgazione, dimostrandone il reale valore.

Gli ultimi blog