Visualizzazione post con etichetta assistenti vocali. Mostra tutti i post
Visualizzazione post con etichetta assistenti vocali. Mostra tutti i post

venerdì 23 giugno 2023

Donati e altri, A Clinical Tool for Prognosis and Speech Rehabilitation in Dysarthric Patients: The DESIRE Project

 
Copertina di ApplePies 2022
Da diversi mesi non aggiorno le presentazioni delle mie pubblicazioni qui sul blog. Finalmente è arrivato il momento di farlo… e sono lieto di iniziare da un lavoro interessante e meritorio, anche se il mio contributo è stato marginale nell’economia compessiva.
 
Negli atti della conferenza ApplePies (International Conference on Applications in Electronics Pervading Industry, Environment and Society) è infatti uscito un intervento di diversi autori. Più precisamente, l’intervento è uscito negli atti della conferenza 2022 e gli autori sono, nell’ordine di presentazione, Massimiliano Donati, Alessio Bechini, Clelia D’Anna, Bruno Fattori, Martina Olivelli, Susanna Pelagatti, Giulia Ricci, Erika Schirinzi, Gabriele Siciliano, Mirko Tavosanis, Francesca Torri, Nicola Vanello e Luca Fanucci. L’intervento in sé poi si intitola A Clinical Tool for Prognosis and Speech Rehabilitation in Dysarthric Patients: The DESIRE Project ed è stato realizzato nell’ambito di un Progetto di Ricerca di Ateneo (PRA) dell’Università di Pisa.
 
Due parole di contesto: la disartria è un disturbo del linguaggio, dovuto a problemi di movimento che disturba il parlato di chi ne soffre e, a seconda della gravità, può renderlo quasi impossibile da comprendere per chi non conosce bene il paziente. Il gruppo che si è occupato del contributo ha lavorato allo sviluppo di DESIRE, uno strumento che analizza diverse sessioni di lettura in cui i pazienti pronunciano ad alta voce parole specifiche predefinite. Lo strumento è stato pensato per agevolare il controllo della progressione della malattia e i risultati della riabilitazione: elabora infatti una misura che indica quanto la pronuncia del paziente si discosta rispetto alle sessioni precedenti e dalle prestazioni attese.
 
Per raggiungere questo risultato, DESIRE valuta il modo in cui i pazienti pronunciano i fonemi e i gruppi di consonanti della lingua italiana, oltre ai tempi di pronuncia delle parole. Il mio lavoro quindi è stato di supervisione degli aspetti linguistici, in supporto a una serie di controlli preliminari svolti da una mia laureanda (poi laureata), Ludovica Corsi. Il mio è stato appunto un contributo modesto, ma mi ha fatto molto piacere poterlo dare in rapporto a una questione medica vicina ad altre che mi coinvolgono direttamente.
 
Aggiungo, a monte, che il lavoro di Ludovica Corsi ha chiarito bene quanto il linguaggio disartrico possa essere divergente da quello dell’utente tipico, e quanto ciò limiti l’utilità degli assistenti vocali oggi di uso comune. Anche questa è una direzione in cui sarebbe molto opportuno approfondire gli studi.
 
Donati e altri, A Clinical Tool for Prognosis and Speech Rehabilitation in Dysarthric Patients: The DESIRE Project, in International Conference on Applications in Electronics Pervading Industry, Environment and Society, a cura di Riccardo Berta e Alessandro Gloria, Springer, 2023, pp. 380-385, DOI https://dx.doi.org/10.1007/978-3-031-30333-3_52, Scopus 2-s2.0-85161416842.
 

martedì 19 ottobre 2021

Pieraccini, AI Assistants


 
Copertina di Roberto Pieraccini, AI Assistants
A parer mio, i moderni assistenti digitali sono prodotti di estremo interesse per la linguistica e potrebbero avere sviluppi rivoluzionari in particolare nell’insegnamento delle lingue. Quasi quattro anni fa (!) ne avevo parlato nel mio Lingue e intelligenza artificiale, ma negli anni seguenti lo sviluppo è stato notevolissimo. Tanto per dirne una, quando il mio libro è uscito non erano ancora arrivati in Italia gli altoparlanti intelligenti, come i sistemi Alexa di Amazon e Google Home, e i sistemi di dialogo in commercio avevano appena iniziato a mantenere il contesto della conversazione…
 
Eppure, nonostante gli sviluppi e le promesse, le pubblicazioni in proposito sono state ben poche. Solo negli ultimi mesi sono finalmente comparsi alcuni libri che descrivono in modo sistematico i moderni assistenti digitali, che fino a oggi erano descritti in sostanza solo dalle pubblicazioni specialistiche (con molte informazioni rimaste implicite nelle conoscenze dei ricercatori) o da istruzioni per l’uso come quelle di Dialogflow.
 
Del secondo di questi libri, Hey, Cyba!, conto di parlare più avanti. Qui invece vorrei parlare di AI Assistants, che, firmato da Roberto Pieraccini per la collana Essential Knowledge del MIT, finalmente descrive in modo sistematico il funzionamento degli assistenti digitali moderni.
 
Da un certo punto di vista il libro può essere considerato un’appendice o una continuazione dell’ottimo The Voice in the Machine dello stesso autore. Buona parte dello spazio, in effetti, è dedicata, più che agli assistenti digitali in sé, ai loro prerequisiti, cioè allo sviluppo delle tecnologie vocali dal dopoguerra a oggi. Questa storia era già stata raccontata in dettaglio appunto da The Voice in the Machine, ma la sovrapposizione tra i due libri è più ridotta di quanto si potrebbe immaginare: l’autore ha trattato il tema in modo nuovo. E soprattutto, queste informazioni sono importanti per comprendere molti aspetti del funzionamento degli assistenti digitali.
 
Una simile scelta fa sì che le caratteristiche specifiche degli assistenti digitali in quanto tali siano presentate solo nei due ultimi capitoli: il sesto, dedicato a The Dialog Manager, e il settimo, Interacting with an Assistant. Chi si sente già preparato sui modelli di Markov nascosti o sulle difficoltà connesse alla generazione del parlato potrebbe quindi essere tentato di saltare direttamente a questi… ma credo che sarebbe un peccato, perché la descrizione delle fasi precedenti è comunque interessante in questa nuova prospettiva.
 
Inoltre, molte delle informazioni presentate sono sì diffuse nell’ambiente, ma poco formalizzate e descritte. Questo fa sì che il testo fornisca informazioni difficilissime da ricostruire per gli esterni, come questa descrizione dello stato dell’arte per la gestione di pronomi e frasi incomplete:
 
Modern assistants are able to manage referential pronouns and incomplete sentences (called elliptical sentences) based on algorithms that unravel the structure of each query, determine whether the query is incomplete and missing elements such as the specific subject or intent, and try to answer it by resolving the missing elements with the right information. Those algorithms are based on a mix of language rules and the results of data analysis on large corpora of queries done in the past and aggregated over all the users (p. 169).
 
In questo punto, e in molti altri, non ci sono rinvii a fonti di informazione specifiche, e la cosa non mi sorprende. Dove si dovrebbero trovare, del resto?
 
In quanto alle modalità di esposizione, sono fondamentalmente non tecniche (e corrette e approfondite per quanto riguarda le componenti linguistiche). Tuttavia, come già succedeva in The Voice in the Machine, in alcuni punti sono molto sintetiche: nelle parti più tecniche è difficile che il lettore non informato possa comprendere tutto ciò che viene detto.
 
L’esposizione arriva però anche al personale nell’ultimo capitolo. Pieraccini, viareggino, laureato in Ingegneria a Pisa, ha lavorato a Torino al CSELT per poi spostarsi oltreoceano ai mitici Bell Labs e da lì a molte delle principali aziende del settore, avendo occasione di contribuire in prima persona a molti degli sviluppi descritti qui (adesso è Director of Engineering per Google Assistant a Zurigo). Uno di questi contributi ha riguardato lo sviluppo del “robot sociale” Jibo, che ha avuto una storia complessa e ha lasciato un segno importante, apparentemente, sia nella comunità degli sviluppatori sia tra gli utenti. Le pagine dedicate a questo argomento, oltre a essere tra le più interessanti nella mia prospettiva, mostrano un coinvolgimento non superficiale.
 
In definitiva: il libro è caldamente raccomandato a chiunque sia interessato a questi argomenti.
 
Roberto Pieraccini, AI Assistants, Cambridge (Massachusetts), MIT Press, 2021, pp. 288 (edizione tascabile), ISBN (edizione tascabile) 978-0-26254255-5, letto nell’edizione Kindle, ASIN B08PY9X5YF, € 10,99.
 

giovedì 11 ottobre 2018

Da HAL all'assistente vocale

  
 
Da HAL all'assistente vocale
Negli ultimi mesi sono stato impegnatissimo a preparare una serie di eventi e presentazioni che andranno avanti fino al 18 novembre. Più che altro si tratta di eventi collegati alla Settimana della lingua italiana nel mondo… ma si inizia domani, venerdì 12 ottobre, quando dalle 15 alle 18, all’interno dell’Internet Festival di Pisa si svolgerà l’evento Da HAL all'assistente vocale. L'evento si svolgerà presso il Museo degli strumenti per il calcolo (Vecchi Macelli), Palazzina A1. Ecco il programma!
 
Moderatore: Gianni Del Vecchio (Huffington Post)
 
Introduzione – Mirko Tavosanis (Università di Pisa): ore 15
 
15:10-15:30 – Franco Cutugno (Università di Napoli) - Interazione Naturale Multimodale: uomini e avatar che dialogano in ambienti virtuali tridimensionali
 
15:30-15:50 – Roberto Basili (Università di Roma "Tor Vergata") - Linguaggio naturale, apprendimento nelle macchine e robotica
 
15:50-16:10 – Maria Palmerini (Cedat85, Roma) - Il riconoscimento del parlato: applicazioni, criticità e pregiudizi
 
16:10-17:00 – Tavola rotonda. Relatori e relatrici: Franco Cutugno, Mirko Tavosanis, Roberto Basili, Maria Palmerini, Roberto Pieraccini, Carlo Aliprandi
 
17:00-18:00 – Demo della Guida Museo con Google Home
 

venerdì 1 settembre 2017

Ultimi interventi sul sito Treccani


 
Sul sito Treccani.it sono usciti nei primi mesi dell’anno diversi interventi miei. Non ne avevo ancora parlato su questo blog, ma rimedio adesso.
 
Il primo è stato un intervento su L’italiano e gli assistenti vocali, una rapida sintesi di argomenti su cui ho appena finito di scrivere un libro di prossima pubblicazione.
 
Il secondo contributo ha riguardato Il futuro in vesti classiche di Damiano Malabaila, cioè l’intreccio tra linguaggio e narrativa di genere nelle opere fantascientifiche di Primo Levi.
 
 
Creative Commons License
Blog di Mirko Tavosanis by http://linguaggiodelweb.blogspot.com is licensed under a Creative Commons Attribuzione-Non opere derivate 2.5 Italia License.