La dottoressa Alessia Dorigoni da anni si dedica alla ricerca alla docenza e alla consulenza, con un approccio interdisciplinare che combina neuroscienze, economia comportamentale e creatività. Ora sta studiando (e provando a misurare) il paraverbale e il non verbale. Abbiamo fatto due chiacchiere.
Comincerei con una domanda da profano: ma esiste il paraverbale?
Domanda legittima! Il paraverbale esiste eccome, anche se non lo trovi scritto nei vocabolari accanto alle parole ‘fisica’, ‘gravità’ o ‘ossigeno’.
Ok, definizione?
È il modo in cui la voce accompagna le parole: il tono, il ritmo, le pause, insomma, tutto ciò che fa la differenza tra un ‘Ti amo’ sussurrato e uno urlato durante una lite. Forse è anche il suono della parola a trarci in inganno a parer mio: para-verbale. Sarà che ricorda un po’ il paranormale, e gli dà quest’aura di qualcosa che sta tra il visibile e l’invisibile, tra il detto e il non detto, ovviamente per la presenza del prefisso -para… Ma no, niente spiriti: il paraverbale è molto terreno, anche se potentissimo; talmente potente che in una comunicazione incongrua, quando cioè il verbale dice una cosa e il paraverbale dice l’opposto, il paraverbale ha la meglio sul verbale nel trasmettere il messaggio.
Un esempio?
Prendiamo questa frase: ‘Sono felicissimo per te”. Significato verbale molto chiaro e inequivocabile, eppure! Ora immagina di dirla con voce piatta, tono freddo, sguardo sfuggente all’uomo che ha appena sposato la donna che hai desiderato per anni. Le parole dicono una cosa, ma il tono racconta la verità. E quella verità non è gioia: è amarezza, gelosia, distacco e la persona davanti a te capirà sicuramente il messaggio.
Conta come lo dici?
Sì, chi ascolta non percepisce il contenuto, percepisce l’intenzione. In quel momento, non conta cosa dici. Se fosse solo un’invenzione creativa, i podcast sarebbero noiosi quanto leggere il libretto delle istruzioni del microonde, i politici non perderebbero ore a lavorare su dizione e tono, ma solo sui contenuti e un attore bravo non farebbe la differenza perché direbbe le stesse identiche parole degli altri, nel medesimo modo. Il paraverbale è insomma quella parte della voce che accompagna le parole senza essere parola. Senza paraverbale saremmo dei robot con un copione. Le stesse parole potrebbero suonare come una carezza o come un rimprovero, ma senza tono, ritmo, pause, saremmo piatti, inespressivi ma soprattutto ambigui perché non si capirebbero le nostre vere intenzioni, quelle più profonde e sentite.
Ok, c’è un modo per rubricarlo?
Nella comunicazione distinguiamo tre grandi dimensioni: il verbale: cioè le parole, il contenuto esplicito di ciò che diciamo; il paraverbale: come lo diciamo, tono di voce, ritmo, pause, volume. È ciò che colora le parole, le rende calde o fredde, sincere o sarcastiche; il non verbale: tutto ciò che comunichiamo col corpo, espressioni facciali, postura, gesti, sguardo, distanza.
Immagino ci sia un modo per misurare il paraverbale, l’incongruità tra quello che dici e tra come lo dici?
Sì, oggi possiamo misurare la componente paraverbale della comunicazione; la vocal analysis viene effettuata tramite una combinazione di hardware (microfoni) e software (algoritmi di elaborazione del segnale e intelligenza artificiale) che consente di misurare in modo oggettivo le caratteristiche acustiche della voce principalmente su tre livelli: la prosodia, che comprende parametri acustici come la frequenza fondamentale (che determina la percezione del tono), la loudness (ovvero l’intensità percepita della voce), la variazione dell’intonazione e la velocità dell’eloquio.
Che rivelano questa caratteristiche?
Queste caratteristiche permettono di rilevare segnali di attivazione emotiva, urgenza comunicativa o al contrario appiattimento espressivo; le dimensioni emozionali della voce appartengono al secondo livello e vengono rappresentate lungo assi continui di attivazione (eccitazione vs rilassamento), valenza (positività vs negatività) e dominanza (controllo vs sottomissione). Questo approccio consente di cogliere sfumature affettive anche sottili, e di interpretare il grado di coinvolgimento o distacco rispetto a ciò che viene detto; infine, il terzo livello riguarda la classificazione in categorie emozionali discrete, come gioia, rabbia, tristezza e neutralità. Queste vengono riconosciute automaticamente da algoritmi di machine learning, che assegnano a ogni segmento vocale un punteggio di probabilità rispetto a ciascuna emozione.
Quindi gli algoritmi potenziano quello che già siamo soliti fare?
Sì, del resto, lo percepiamo ogni giorno: anche senza vedere il volto di una persona, spesso ci basta ascoltarne la voce per capire se è davvero felice, se è stanca, oppure se sta nascondendo qualcosa. La rilevanza di questi strumenti non è solo teorica. A livello evolutivo, il paraverbale ha rappresentato un canale comunicativo primario, presente ben prima del linguaggio articolato, fondamentale per riconoscere pericoli, stabilire alleanze e regolare la vita sociale.
Quindi è fondamentale, una dimensione pre orale?
Sì, studi recenti dimostrano che non riuscire a riconoscere o modulare correttamente la prosodia può compromettere profondamente la qualità delle relazioni sociali e affettive. In altre parole, quando non cogliamo “il tono” con cui qualcosa viene detto, o non siamo in grado di trasmetterlo, il rischio è quello di fraintendere intenzioni, emozioni, confini.
Ma ci sono studi in merito?
Un lavoro condotto da Tiberi e colleghi (2025) lo mostra con particolare chiarezza: soggetti detenuti per reati sessuali hanno mostrato gravi difficoltà nel riconoscere le emozioni trasmesse dalla voce, soprattutto gioia e tristezza, accompagnate da una scarsa consapevolezza dei propri errori di interpretazione. Si tratta di un deficit che può ostacolare profondamente la capacità di entrare in sintonia con l’altro, con implicazioni dirette sulla regolazione del comportamento. Un’altra prospettiva interessante è offerta dallo studio di Hannah Walsh (2021), che ha analizzato il profilo vocale di individui con tratti psicopatici. Anche quando raccontano eventi emotivamente significativi, la loro voce tende a rimanere piatta, priva di modulazioni prosodiche. Il risultato è un’apparente disconnessione tra ciò che dicono e come lo dicono. Come sottolinea l’autrice: “They understand the lyrics, but not the music”.
Altre caratteristiche?
L’analisi vocale non è utile solo per individuare criticità. È anche uno strumento prezioso per monitorare i cambiamenti nel tempo. Ad esempio, è stata utilizzata per valutare l’efficacia delle terapie contro l’ansia sociale, misurando l’evoluzione della voce dei pazienti prima e dopo il trattamento (Laukka et al., 2008). Ma la sua utilità si estende ben oltre il contesto clinico: nel campo delle scienze sociali e comportamentali viene spesso impiegata per esplorare fenomeni più quotidiani e affascinanti: si è visto, ad esempio, che le preferenze femminili per certe caratteristiche vocali maschili cambiano nel corso del ciclo mestruale (Puts, 2005), o che modificare la propria voce può influenzare la percezione di sé (Stel et al., 2011). Altri studi hanno addirittura usato l’analisi della voce per prevedere l’esito di elezioni politiche (Banai et al., 2017). L’interesse per la voce cresce anche in ambito pubblico e professionale. Uno studio interessante ha confrontato le caratteristiche vocali di Steve Jobs con quelle di un presentatore medio, evidenziando marcate differenze nella capacità di coinvolgere il pubblico (Niebuhr et al., 2016). In questo contesto, l’analisi vocale viene oggi impiegata nel coaching per il public speaking, nella formazione aziendale e nella selezione di figure comunicative di rilievo.
Come possono venire applicate queste scoperte nell’ambito della criminologia?
Le applicazioni sono molteplici e nell’ambito criminologico, l’analisi paraverbale e non verbale può diventare un supporto importante nei contesti ad alta ambiguità comunicativa, come gli interrogatori o la valutazione delle testimonianze. Ad esempio, sapere che alcuni indici vocali possono essere associati a un tentativo di inibizione emotiva o a una manipolazione intenzionale del messaggio, aiuta l’intervistatore a porre domande più mirate o a leggere meglio le incongruenze tra ciò che viene detto e ciò che viene sentito. In questo senso, la voce, o le espressioni facciali diventano fonte informativa, al pari delle parole e dei fatti. È stata applicata l’intelligenza artificiale ad esempio all’analisi della menzogna. In uno studio recente “Explainable Enhanced Recurrent Neural Network for lie detection using voice stress analysis” (Talaat, 2024) è stato sviluppato un algoritmo basato su reti neurali ricorrenti LSTM ottimizzate con logica fuzzy, addestrato su registrazioni audio di interviste. Il modello ha raggiunto un’accuratezza del 97,3% nell’identificare pattern vocali legati allo stress da menzogna.
Sento crescere una leggera inquietudine, ma il viso è interessato, immagino?
Certo, anche qui sono stati sviluppati degli algoritmi in grado di leggere automaticamente l’attivazione dei muscoli facciali. La capacità umana di leggere le emozioni altrui, soprattutto se adeguatamente addestrata però rimane molto superiore a qualsiasi algoritmo. Questo perché una persona è in grado di percepire situazioni complesse in cui contemporaneamente si provano due emozioni diverse o quando un’emozione sta lentamente trasformandosi in un’altra, sfumature che spesso sfuggono anche ai modelli più avanzati. Poi c’è una cosa che ho sempre trovato molto affascinante…
Quale?
Alcuni studi (Bérubé e colleghi, 2023) dimostrano che chi ha vissuto un’infanzia difficile, con esperienze di maltrattamento fisico, emotivo o trascuratezza, sviluppa una sensibilità emotiva particolare nella lettura delle microespressioni facciali, soprattutto verso emozioni negative come rabbia e paura. Questa “super-competenza” è un meccanismo adattivo sviluppato per sopravvivere in ambienti minacciosi. Tuttavia, questa ipersensibilità può anche portare a fraintendimenti sociali, come interpretare segnali neutri come ostili, con conseguenti difficoltà nelle relazioni interpersonali.
Qui in Italia siamo agli albori, immagino?
In Italia, questo tipo di analisi paraverbale e non verbale non è ancora molto diffuso né sfruttato appieno, mentre negli Stati Uniti, dove queste tecniche sono nate e si sono sviluppate, come nella famosa Behavioral Science Unit dell’FBI a Quantico, sono invece parte integrante di molti processi investigativi e di intelligence. Questo divario evidenzia un’importante opportunità di crescita e innovazione anche nel nostro paese, soprattutto in ambiti ad alta complessità comunicativa come il diritto penale e la psicologia forense. Questi tipi di analisi a parer mio, nonostante non possano venire considerati prove definitive in tribunale, rappresentano comunque uno strumento prezioso durante la fase investigativa, quando ancora si brancola nel buio nella ricerca dei sospettati. Possono fornire indizi utili per orientare le indagini e aiutare gli investigatori a formulare ipotesi più precise.
Vorrei concludere con due domande? La prima si può imbrogliare? Una maggiore consapevolezza di come funzioniamo può insegnarci anche i trucchi per ingannare le macchine?
Solo in parte. Possiamo allenarci a controllare il tono della voce, la postura, le espressioni del viso. Ma è importante chiarire che ci vogliono anni di studio per imparare davvero a leggere e soprattutto a manipolare questi segnali. Prendiamo il FACS (Facial Action Coding System): serve a codificare ogni minima contrazione muscolare del volto, le microespressioni facciali. Per usarlo correttamente servono centinaia di ore di formazione. Lo stesso vale per il controllo del linguaggio del corpo e delle componenti vocali, tono, frequenza, pause, ritmo. Conoscerle non vuol dire saperle usare per ingannare. Anzi, spesso più si prova a controllare tutto, più emergono incongruenze: piccoli segnali disallineati che un osservatore esperto o un algoritmo possono rilevare. Qui entra in gioco l’approccio multicanale.
Cioè?
Le tecnologie attuali non analizzano un singolo segnale isolato, ma integrano voce, espressioni facciali, movimenti oculari e parametri fisiologici per individuare pattern non coerenti. Nessun canale è affidabile da solo, ma l’insieme permette di cogliere la tensione emotiva e cognitiva che può accompagnare una menzogna. Studi come quello di Tasgaonkar et al. (2025) dimostrano che questa integrazione migliora enormemente l’accuratezza nella rilevazione dell’inganno. E ciò che la ricerca mostra con chiarezza è che, quando si mente, non ci si irrigidisce necessariamente. Anzi, il tentativo di apparire credibili può generare un’attivazione motoria ancora maggiore. Lo dimostra Van der Zee (2019): chi mente tende a muoversi di più, e nei casi più cognitivamente impegnativi può perfino imitare inconsciamente i gesti dell’interlocutore, è il cosiddetto effetto “copycat”.
Cos’è?
Una strategia automatica di adattamento sociale che, proprio perché difficile da controllare, può rivelare un elevato carico cognitivo. In sintesi, possiamo aumentare la nostra consapevolezza comunicativa, possiamo imparare a leggere meglio gli altri, ma ingannare davvero, su tutti i canali e in modo coerente, è estremamente difficile. Perché mente e corpo non mentono mai del tutto all’unisono, e proprio nel tentativo di controllarli entrambi, spesso si svela di più di quanto si vorrebbe.
Questi nuovi studi possono insegnarci come funzioniamo davvero? Chi siamo, perché mentiamo, perché diciamo la verità?
Sì, ed è forse la cosa più affascinante di questo ambito: ci aiuta non solo a riconoscere gli inganni, ma a esplorare le dinamiche profonde che ci definiscono come esseri umani. Il paraverbale e il non verbale ci permettono di accedere a una verità che spesso nemmeno le parole sanno raccontare e che nemmeno noi sappiamo riconoscere. Il paraverbale e il non verbale in realtà sanno cose di noi che magari nemmeno noi sappiamo consciamente.
Esempio?
Un esempio che mi ha colpito è stato quello di Enzo Kermol, Presidente dell’Associazione nazionale degli Analisti del comportamento emozionale del volto Emotusologi (AAE), durante una sua lezione: Catriona Gray, Miss Filippine, nel momento della sua incoronazione a Miss Universo nel 2018; il suo volto mostra segnali inaspettati, contrazione delle sopracciglia, la retrazione del labbro superiore, e l’attivazione delle scissure naso-labiali, indicatori tipici di emozioni quali tristezza e disgusto. Eppure aveva appena vinto.
E infatti…
In apparenza incongruente con l’evento gioioso, questa configurazione può invece riflettere un’attivazione emotiva complessa: il carico di stress, le rinunce personali, la pressione dell’esposizione pubblica. Non si tratta di contraddizione, ma di co-esistenza emotiva scaturita, molto probabilmente, da ricordi. In quel momento il suo volto non diceva “sono infelice”, ma forse: “non è stato facile arrivare fin qui”.
Quindi il preverbale potrebbe raccontare anche una storia retrodatata? E non solo l’evento menzognero?
Questo vale nei contesti forensi: testimoni sinceri ma insicuri possono sembrare poco credibili, mentre chi mente con calma apparente può risultare affidabile (Raver et al., 2025; Burgoon, 2018). È qui che l’approccio multicanale diventa essenziale: solo osservando voce, volto, postura, fisiologia insieme, possiamo iniziare a leggere il quadro completo.
In altre parole: mentre il linguaggio conscio racconta la versione narrativa dell’esperienza, i segnali paralinguistici e non verbali traducono la componente fisiologica, automatica ed emotiva, offrendo una visione più sfumata e talvolta più autentica del nostro stato interno. Anche per questo motivo, molti studi forensi e clinici mettono in guardia da interpretazioni semplicistiche: ad esempio, una voce tremante non indica automaticamente menzogna, così come una voce calma non garantisce verità (Van Puyvelde et al., 2018).
Quindi il contesto è fondamentale?
Si, questi segnali vanno sempre letti nel contesto, e idealmente integrati tra loro.
In definitiva, questi studi non ci rivelano solo se stiamo mentendo o dicendo la verità, ma ci mostrano come si struttura, si regola e si manifesta la nostra esperienza emotiva e cognitiva, spesso al di là delle parole. Ci aiutano a vedere la tensione tra ciò che diciamo e ciò che proviamo, tra ciò che vorremmo mostrare e ciò che trapela. Non si tratta di trovare una verità assoluta, ma di ascoltare i segnali che emergono quando le emozioni sono troppo forti per essere contenute solo nelle parole.
Quindi la risposta è sì?
In questo senso, sì: questi studi ci insegnano come funzioniamo davvero. Ci aiutano a capire non solo quando mentiamo, ma anche cosa ci spinge a farlo, e cosa accade dentro di noi quando invece scegliamo la verità.








