,
Questo esempio mostra passo dopo passo come funziona un semplice processo di analisi testuale automatizzata. A partire da due frasi, vedrai come il testo viene scomposto in parole (token), classificate per funzione, analizzate per lessico e sentiment, e infine valutate con un indice di leggibilità. Ogni passaggio è animato e navigabile in autonomia.
In questo passaggio si presenta un breve testo composto da due frasi, che serviranno come base per le analisi successive. Le frasi sono scelte per contenere parole significative, strutture grammaticali comuni e una certa carica emotiva.
"La bellezza del linguaggio è la chiave per la comprensione del mondo. Le parole, scelte con cura, possono aprire porte che la logica da sola non riesce a scardinare."
Qui il testo viene suddiviso in singole parole, chiamate "token", che rappresentano le unità fondamentali per l’analisi linguistica automatica.
Token: ["La", "bellezza", "del", "linguaggio", "è", "la", "chiave", "per", "la", "comprensione", "del", "mondo", "Le", "parole", "scelte", "con", "cura", "possono", "aprire", "porte", "che", "la", "logica", "da", "sola", "non", "riesce", "a", "scardinare"]
Le parole vengono classificate in due gruppi: parole di contenuto (significative) e stop words (parole funzionali come articoli, preposizioni, ecc.).
Parole di contenuto: ["bellezza", "linguaggio", "chiave", "comprensione", "mondo", "parole", "scelte", "cura", "aprire", "porte", "logica", "scardinare"]
Stop words: ["la", "del", "è", "per", "Le", "con", "che", "da", "sola", "non", "riesce", "a"]
In questo passaggio vengono identificate le parti del discorso principali: sostantivi, verbi, aggettivi, ecc., per comprendere la struttura linguistica.
Sostantivi: bellezza, linguaggio, chiave, comprensione, mondo, parole, cura, porte, logica
Verbi: è, possono, aprire, riesce, scardinare, scelte (participio passato)
Le parole più rilevanti del testo vengono estratte come "keywords", ordinate in base a un punteggio di importanza semantica.
Keywords: ["linguaggio" (0.95), "comprensione" (0.90), "logica" (0.87), "bellezza" (0.85), "porte" (0.80)]
Si effettua un conteggio delle parole di contenuto (cioè semanticamente rilevanti) e delle parole vuote o funzionali (stop words), per comprendere il bilanciamento informativo del testo.
Parole di contenuto: 12
Stop words: 12
Percentuali: 50% contenuto, 50% stop words
Analisi della lunghezza media delle parole e delle frasi, utile per stimare la complessità sintattica e lessicale del testo.
Lunghezza media parole: 6.2 caratteri
Lunghezza media frasi: 15 parole
Viene analizzato il tono emotivo del testo per determinare se il contenuto esprime un sentimento positivo, negativo o neutro.
Sentimento positivo: 72% (confidence: 87%)
Si calcola quanto è facile da leggere il testo attraverso un indice di leggibilità. Più il punteggio è alto, più il testo è accessibile.
Indice Flesch-Kincaid: 47
Comprensibile per lettori con istruzione superiore
In questo riepilogo finale vengono sintetizzati tutti i dati ottenuti nei passaggi precedenti, offrendo una panoramica completa dell’analisi.