Data Scientist indipendente specializzato in data analysis, data cleaning avanzato, machine learning e sviluppo di sistemi di intelligenza artificiale.
Sviluppo dataset, notebook, modelli predittivi e progetti educativi in diversi ambiti, con particolare attenzione all’analisi di dati pubblici, sistemi istituzionali, dinamiche socio-economiche, AI agent e language model costruiti dalle basi.
Mi occupo di:
- integrazione di dataset eterogenei;
- costruzione di indicatori comparabili;
- sviluppo di analisi riproducibili;
- auditing e controllo della qualità dei dati;
- modelli predittivi e supporto alle decisioni;
- progettazione di AI agent;
- sviluppo progressivo di language model from scratch.
Utilizzo principalmente Python per trasformare dati complessi in informazioni affidabili, comprensibili e utilizzabili e per studiare in modo trasparente i meccanismi alla base dei sistemi di intelligenza artificiale.
- Datasets Expert: rank 76 su 10.784 - miglior rank raggiunto: 70 - 13 medaglie (9 argento e 4 bronzo)
- Notebooks Expert: rank 557 su 61.656 - miglior rank raggiunto: 515 - 17 medaglie di bronzo
| Progetto | Ambito | Strumenti e caratteristiche |
|---|---|---|
| Customer Support Agent | AI Agent / Human-in-the-loop | Google ADK, Gemini, classificazione delle email ed escalation umana |
| Building AI Agent | AI Agent from scratch | Python standard, routing, planning, parsing, esecuzione di tool e memoria |
| Building LLM | Language Model from scratch | Percorso progressivo da un modello statistico a caratteri a uno small Transformer decoder-only |
| Global Inequality and Poverty - 1980-2024 | Socio-economia | Data integration e costruzione di indicatori globali comparabili |
| Italian Justice System Workload | Dati istituzionali | Analisi civile e penale 2003-2024, auditing e controllo dei dati |
| Home Credit Default Risk | Credit Risk / Machine Learning | XGBoost, LightGBM, SHAP e feature engineering |
| Global Emissions & Temperature - 1950–2024 | Clima e serie storiche | Analisi di CO₂, gas serra e temperature globali |
- Data quality e data cleaning
- Machine learning applicato
- Explainable AI
- AI agent e automazione
- Natural Language Processing
- Language model e Transformer
- Intelligenza artificiale from scratch
- Dati pubblici e istituzionali
- Analisi socio-economiche
- Serie storiche e indicatori comparabili
- Ricerca riproducibile