Ingestione documenti
PDF, Excel, documenti scansionati e immagini elaborati con OCR tramite Google Document AI e Gemini per classificazione e estrazione strutturata. Layout KID eterogenei, tabelle multilingua e scansioni rumorose confluiscono in un unico schema normalizzato.
Validazione e arricchimento
Categorizzazione degli asset, matching degli ISIN, arricchimento via web, analisi dei documenti KID ed estrazione dei costi su fonti eterogenee. Ogni campo estratto è abbinato a un punteggio di fiducia e a un percorso di correzione in un click per l'analista.
Database e GDPR
Contributo al design del database per lo storage degli asset e il tracking storico, garantendo tracciabilità del dato e processing GDPR-compliant lungo tutta la pipeline.
Reportistica e API
Generazione di report professionali PDF ed Excel con benchmark "Vecchio vs Nuovo"; sviluppo di un'applicazione prototipo e di un layer API per l'intero flusso da ingestione a reportistica.