Marco Anisetti Sviluppo di una soluzione per collezionare e valutare la qualità dei dati in ingresso in modo indipendente dalla finalità e peculiarità del dato stesso. L’attività sperimentale Sviluppo e realizzazione...
Leggi tuttoAcquisizione e modellazione dei dati, gestione del data lake
Implementazione della raccolta, gestione e modellazione dei dati tramite architetture ETL (Extract, Transform, Load) / ELT (Extract, Load, Transform) sviluppando modelli di analisi avanzata e garantendo la qualità e la sicurezza dei dati.
- Dati e Gestione;
- Modelli di analisi ed elaborazione;
- Seminari metodologici;
- Cloud Continuum e pipeline ETL e ELT;
- Open Science Open Data.
Casi studio
Dati e Gestione
- Identificazione di ulteriori fonti autorevoli di letteratura e open data utili per le nuove attività;
- Ampliamento dei dati raccolti da analisi chimico-analitiche, assunzioni alimentari, survey e dati giuridici;
- Valutazione della qualità dei dati tramite protocolli affidabili e “best practice”, con particolare attenzione agli inquinanti emergenti;
- Strutturazione architetturale e meta-modellazione dei dati per garantire verifiche e trasformazioni prima dell’ingestione e durante il rilascio, in conformità alle normative vigenti.
Modelli di analisi ed elaborazione
- Sviluppo e applicazione di modelli statistici allo stato dell’arte, specifici per ogni dominio analizzato;
- Esplorazione di modellazioni basate su apprendimento automatico (machine learning), soprattutto per la valutazione del rischio derivante dall’esposizione a inquinanti negli ambienti di vita e di lavoro;
- Integrazione dei dati raccolti nei modelli per ottenere informazioni predittive e di supporto decisionale.
Seminari metodologici
- Progettazione e realizzazione di attività seminariali rivolte ai membri del consorzio e, potenzialmente, agli stakeholder esterni;
- Presentazione dello stato dell’arte nelle metodologie di analisi dati e nelle tecnologie di apprendimento automatico;
- Approfondimento degli aspetti metodologici emergenti dalle specificità dei dati prodotti nel consorzio.
Cloud Continuum e pipeline ETL/ELT
- Sviluppo di pipeline di acquisizione dati sia in modalità ETL (Extract, Transform, Load) che ELT (Extract, Load, Transform);
- Implementazione delle pipeline sul Cloud Continuum, con gestione avanzata di proprietà come confidenzialità, privacy e sicurezza.
Open Science e Open Data
- Definizione di strategie e policy per:
- Il rilascio di viste sui dati specifiche e conformi alle normative sulla privacy;
- L’evoluzione della piattaforma in ottica di contribuzione alla comunità scientifica.
- Promozione della condivisione dei dati secondo i principi FAIR e Open Science.
Per prrofondire
Marco Anisetti Nel paradigma One Health, l’analisi del rischio legato all’esposizione a inquinanti in ambienti di vita e di lavoro può essere potenziata da modelli di apprendimento automatico che integrano dati eterogenei...
Leggi tuttoMarco Anisetti L’attività ha riguardato la progettazione e realizzazione di attività seminariali volte a disseminare lo stato dell’arte nelle metodologie di analisi dati e nelle tecnologie di apprendimento automatico con particolare...
Leggi tuttoMarco Anisetti L’architettura prevede lo sviluppo di pipeline di acquisizione dati sia in modalità ETL (Extract, Transform, Load) che ELT (Extract, Load, Transform). queste pipeline devono essere dispiegate sul Cloud Continuum, con gestione...
Leggi tuttoMarco Anisetti L’attività sperimentale L’attività ha riguardato la verifica della conformità normativa e delle soluzioni tecnologiche per l’attuazione di Open Data. In particolare, sono state analizzate le principali normative del settore, con...
Leggi tutto