loader image

Conferenza: L’italiano e le sue varietà nell’Intelligenza Artificiale

Set 17, 2026 | Eventi

I modelli di intelligenza artificiale sono sempre più presenti nella nostra vita quotidiana, dalla traduzione automatica agli assistenti virtuali.

Ma quanto conoscono davvero l’italiano? E cosa succede quando, oltre alla lingua standard, entrano in gioco dialetti, espressioni regionali o nomi di luoghi noti solo a livello locale?

La crescente diffusione dei modelli di linguaggio di grandi dimensioni (Large Language Models, LLM) solleva una questione che va oltre la loro capacità di “parlare italiano”: come vengono rappresentati l’italiano e le sue varietà all’interno di questi modelli, quasi sempre visto la dimensione, multilingui?

In occasione della Settimana della Lingua Italiana nel Mondo, il linguista Prof. Giuseppe Samo (Beijing Language and Culture University, Cina) affronterà questo tema di grande attualità.

La conferenza, della durata di circa cinquanta minuti, sarà seguita da un momento di dialogo con il pubblico.

L’evento è organizzato dal Comitato degli Italiani all’Estero (Comites) di Ginevra, in collaborazione con l’Università di Ginevra.

Venerdì 23 ottobre, ore 19.30

Sala MR060 UniMail
Università di Ginevra
Bd du Pont-d’Arve 40, 1205 Genève

Conferenza in lingua italiana

Ingresso libero, aperitivo offerto.

Si raccomanda l’iscrizione per facilitare l’organizzazione dell’evento.

Dr. Giuseppe Samo
Professore – Beijing Language and Culture University, Cina

Giuseppe Samo ha conseguito un dottorato in Linguistica presso l’Università di Ginevra con una tesi, successivamente pubblicata come monografia, sulla modellizzazione della sintassi delle lingue a verbo secondo. È stato prima professore associato e poi professore di chiara fama presso la Beijing Language and Culture University. La sua ricerca si concentra sull’interazione tra teoria linguistica e modelli computazionali. È stato professore in visita presso l’Universidade Estadual de Campinas, Short-Time Fellow in AI for Crisis Settings presso il Crimedim dell’Università del Piemonte Orientale e ricercatore in AI presso il centro di ricerca Idiap di Martigny. È autore di oltre 60 pubblicazioni, tra cui due articoli su Nature Communications.

ABSTRACT

La crescente diffusione dei modelli di linguaggio di grandi dimensioni (Large Language Models, LLM) solleva una questione che va oltre la loro capacità di “parlare italiano”: come vengono rappresentati l’italiano e le sue varietà all’interno di questi modelli, quasi sempre visto la dimensione, multilingui?

Dopo aver presentato cosa rappresentano i dati linguistici sintetici, partiremo dagli studi sull’italiano standard, prendendo come punto di riferimento il recente lavoro che riassume l’iniziativa CALAMITA (Nissim et al. 2026), una collaborazione di oltre ottanta ricercatrici e ricercatori dedicata alla valutazione dei modelli linguistici in italiano attraverso vari compiti. Verranno quindi presentati alcuni risultati sulla rappresentazione dell’italiano nei modelli linguistici, con dati naturali e sintetici (Samo & Merlo 2026) e mostrando come le informazioni sintattiche e semantiche sono organizzate all’interno del modello (Nastase et al. 2025).

Questa prospettiva verrà estesa ad altre varietà dell’italiano. I risultati di Massaro & Samo (2023) e Samo & Massaro (2025) mostrano come varietà con risorse di dimensioni diverse sono rappresentate a livello sintassi. Daremo anche uno sguardo alle rappresentazioni lessicali, con un focus sui termini generici geografici locali (Samo & Ursini 2026).

Bibliografia

Massaro, A. & Samo, G. (2023). Prompting Metalinguistic Awareness in Large Language Models: ChatGPT and Bias Effects on the Grammar of Italian and Italian Varieties. Verbum, 14, 1–11. https://doi.org/10.15388/Verb.42.

Nastase, V., Samo, G., Jiang, C. & Merlo, P. 2025. Multilingual vs. Monolingual Transformer Models in Encoding Linguistic Structure and Lexical Abstraction. In Proceedings of the Eleventh Italian Conference on Computational Linguistics (CLiC-it 2025), pages 826–836, Cagliari, Italy. CEUR Workshop Proceedings. http://aclanthology.org/2025.clicit-1.78/

Nissim, M., Croce, D., Patti, V., Basile, P., Attanasio, G., Musacchio, E., et al. (2026). Challenging the Abilities of Large Language Models in Italian: a Community Initiative. Italian Journal of Computational Linguistics, 12(1), 31–109. https://doi.org/10.17454/ijcol121.02.

Samo, G. & Massaro, A. (2025). Syntactic Patterns of Italo-Romance CP-layers in Transformers, ChatGPT and DeepSeek: Two Case Studies from Romansh and Neapolitan. AI-Linguistica. Linguistic Studies on AI-Generated Texts and Discourses, 2(2). https://doi.org/10.62408/ai-ling.v2i2.25.

Samo, G. & Ursini F.A. (2026) “The Semantics of Romance geonyms: Cross-linguistic variation meets context sensitivity”, Nature – Humanities and Social Science Communications, https://doi.org/10.1057/s41599-026-07178-z.

Iscriviti alla newsletter

Ti aggiorneremo su eventi, iniziative riservate alla comunità italiana e altre novità del ComItEs!