lunedì 28 settembre 2026

AI-ROM-IV


Un momento del convegno AI-ROM-IV
Il 21 e il 22 settembre 2026 si è svolto a Dresda il IV convegno AI-ROM, dedicato quest’anno agli “AI-generated Texts in Romance and Germanic Language Varieties”. I testi generati, insomma! Il convegno, ottimamente organizzato, è stato gestito anche quest’anno dal gruppo che fa capo ad Anna-Maria De Cesare alla Technische Universität di Dresda: Anna-Maria De Cesare, Franz Meier, Giulia Mantovani, Michela Gargiulo, Paolo Valentinelli, Tom Weidensdorfer. La novità rispetto al passato consiste nell’ampio spazio accordato alle lingue germaniche, in aggiunta a quelle romanze (che hanno storicamente dato il nome all’evento).
 
Alla quarta edizione, mi sembra che questo convegno rappresenti ormai un punto di riferimento per la ricerca linguistica sui testi generati dall’intelligenza artificiale. Di sicuro, rappresenta anche una buona occasione per riflettere sulla disciplina: quali temi affrontiamo, con quali prospettive e con quali obiettivi?
 
La varietà degli approcci era evidente già nelle relazioni su invito:
  • Sarah Brommer ha parlato delle “ricadute esterne” dei testi generati.
  • Gašper Beguš ha parlato della comunicazione umana e animale.
  • Andrea Nini ha parlato di autorialità e identificazione degli autori. 
Questi temi sono poi rimasti in buona parte autonomi nel programma, salvo quello dell’autorialità, ripreso anche nell’intervento di Ferdinando Longobardi, Laura D’Amodio e Gaia Valeria Gallo.
 
Anche i contributi selezionati sono stati poi molto variati e interessanti. Io ho avuto il compito di condurreuna breve discussione finale, e a questo scopo ho provato a raggruppare i contributi per argomento, tenendo presente anche il quadro preliminare delineato da Franz Meier all’apertura del convegno. Un posto a sé è stato poi occupato dall’importante lavoro descritto da Paramita Mirza, che si distingue dagli altri in quanto riguarda la creazione di un modello linguistico di grandi dimensioni (LLM) multilingue.
   
Negli altri interventi mi sembra di riconoscere due orientamenti generali, che naturalmente si sovrappongono: da una parte, la descrizione e la valutazione dei testi prodotti; dall’altra, il tentativo di mettere alla prova i sistemi, verificandone capacità e limiti in compiti specifici. Gli argomenti affrontati danno un’idea della varietà delle ricerche:
  • Barbara Heinisch: la valutazione della terminologia nei testi prodotti dai modelli.
  • Franz Meier: la descrizione dei tratti di oralità nel Foglio-AI.
  • Francesco Saccà: la valutazione della capacità dei modelli di generare onomatopee.
  • Paolo Valentinelli: le forti somiglianze tra testi generati da modelli diversi.
  • Anna-Maria De Cesare, Giulia Mantovani e Luca Moroni: l’uso dei suffissi nelle favole.
  • Claudia Cusano: le distorsioni nella rappresentazione dei femminicidi nelle notizie generate dall’IA, in rapporto agli orientamenti politici.
  • Ilaria Papagno e Vahram Atayan: la valutazione della capacità dei modelli di semplificare testi medici.
  • Jean Maillard e Stefano Lusito: la valutazione della capacità dei modelli di tradurre in genovese.
È una varietà significativa, che rappresenta comunque solo una parte dei temi possibili (per fare un unico esempio: nessun contributo ha affrontato l’interazione con i chatbot).
 
Una difficoltà comune a queste ricerche, richiamata più volte durante il convegno, riguarda la natura stessa dell’oggetto di studio. Abbiamo molti modelli, simili tra loro ma anche diversi per alcuni aspetti, e assistiamo a progressi rapidi. La competenza linguistica degli esseri umani non cambia con la stessa velocità: studiando i modelli, invece, ci troviamo a inseguire un bersaglio in continuo movimento. L’invecchiamento dei risultati è quindi rapidissimo rispetto ai tempi cui siamo abituati con la linguistica “umana”, e di questo dobbiamo tener conto. Ma forse, più che una difficoltà, è un fattore di stimolo!
 
Faccio poi una nota pratica. Alcuni degli interventi erano in tedesco e io non sarei riuscito a seguirli... ma Google Traduttore ha fatto un ottimo lavoro: l’ho semplicemente attivato sul telefono e la qualità della trascrizione e della traduzione è stata tale da permettermi di star dietro a tutto senza particolari problemi.
 
E per concludere, aggiungo un’osservazione sul contesto. Come mostra il convegno, la ricerca linguistica sui testi generati è ormai una realtà consolidata. Eppure, alla fine di queste interessantissime giornate, mi è venuto da chiedere: perché gli interventi non sono trecento? Quale altro argomento ha oggi un’importanza maggiore per gli studi linguistici? Forse è una valutazione condizionata dai miei interessi, ma mi sembra una domanda da porre!
 

Nessun commento:

Creative Commons License
Blog di Mirko Tavosanis by http://linguaggiodelweb.blogspot.com is licensed under a Creative Commons Attribuzione-Non opere derivate 2.5 Italia License.