Software Engineer
CurrentNel primo periodo ho implementato alcune varianti di classificatore bayesiano multinomiale studiandone le caratteristiche dai paper e applicando alcune ottimizzazioni per lo specifico dominio di applicazione.Poi mi sono concentrato nello studio di tecniche di natural language processing basate su vettorizzazione delle parole che ho utilizzato per realizzare un classificatore su tassonomia cliente o standard UNSPSC. Questo classificatore viene utilizzato da diversi prodotti dell’azienda per pulire ed arricchire automaticamente i dati aziendali dei clienti (es. anagrafica ordini).Ho implementato anche diversi tool con interfaccia grafica utilizzati dai nostri analisti per lavorare con i dati dei clienti, estrarne informazione, ristrutturare l’albero di classificazione, presentare risultati, ...Nell’ultimo periodo sto lavorando all’algoritmo di ricerca duplicati utilizzando la classificazione e sviluppando tecniche ad-hoc analizzando la semantica dei dati. Il risultato ci permette di automatizzare gran parte del lavoro di analisi manuale e di migliorare le anagrafiche dei clienti analizzando i testi degli ordini e identificando oggetti simili anche se descritti in lingua diversa.