WaveRedact
Pipeline open-source per l'offuscamento automatico di dati sensibili (PII) nei file audio.
Repository →Studente di Informatica appassionato di Intelligenza Artificiale, in particolare modelli neurali e linguaggio naturale.
Sono uno studente di Informatica con una profonda passione per l'Intelligenza Artificiale. Mi interessa l'intersezione tra logica e creatività: credo che l'IA sia un ponte tra ciò che immaginiamo e ciò che possiamo costruire. Il mio obiettivo è sviluppare sistemi utili, etici e responsabili.
Stage full-time
Progettazione e sviluppo end-to-end di una pipeline di dati cloud-native su Databricks per ottimizzare il chatbot di supporto tecnico aziendale. Transizione dell'architettura da un approccio puramente generativo a un sistema di caching semantico per minimizzare la latenza di risposta e ridurre drasticamente i costi dei token.
Tech stack: Python, Databricks (Workflows, Foundation Models API), Apache Spark (PySpark), NLP, LLMs (Prompt Engineering), MLflow, BERTopic, Streamlit, Vector Databases, Semantic Caching
Ruolo Part-Time in un contesto retail (Inditex). Migliorate competenze in comunicazione, gestione priorità e collaborazione di team.
Pipeline open-source per l'offuscamento automatico di dati sensibili (PII) nei file audio.
Repository →Classificatore kNN per distinguere maligno/benigno con accuracy 96.48% e recall 93.49% (dataset diagnostico).
Dettagli →Se vuoi parlare di un progetto, collaborazioni o semplicemente scambiare idee sull'AI, scrivimi pure.