Regular papers

  • Capisci a me: The Hidden Risks of Regional Language Processing in LLMs
    Giuseppe Magazzù, Giulia Rizzi and Elisabetta Fersini
  • Don’t Say It!: Constraints, Compliance, and Communication when Language Models Play Taboo
    Sara Candussio, Francesca Padovani, Daniel Scalena and Malvina Nissim
  • Più di Mille Parole? Multimodal and Multilingual Identification of Misogyny Cues in Internet Memes: A Case Study of English, Chinese, and Italian Datasets
    Minggui Duan and Alberto Barrón-Cedeño
  • A Comparative Analysis of Datasets for Privacy Risk Detection in Online Content
    Gaia Gambarelli, Aldo Gangemi, Giovanni Livraga, Biagio Spiezia, Rocco Tripodi and Marco Viviani
  • A Factorial Study of Synthetic Data Generation for Low-Resource Machine Translation using Grammar Books
    Varun Ghat Ravikumar, Sina Ahmadi, Lena Jäger and Rico Sennrich
  • A Logical/Bayesian Backbone for Explainable Argumentation Dynamics in Conversational AI
    Raffaele Di Maso, Emilia Tanda, Domenico Morra, Maria Di Maro and Antonio Origlia
  • Adapting Grounded Semantic Role Labelling to Italian Situated Robot Commands
    Federico Rosati, Claudiu Daniel Hromei, Antonio Scaiella, Danilo Croce and Roberto Basili
  • Advocacy Radar: Monitoring Advocacy for Digital Rights
    Giulio Corradi and Marta Marchiori Manerba
  • AlBERTurin: A Fully Open Family of Italian Encoder Models with Modern Architectures
    Matteo Rinaldi, Marco Madeddu, Calogero Jerik Scozzaro, Matteo Delsanto, Daniele P. Radicioni and Viviana Patti
  • Before the Storm: Estimating Offensive Speech Risk from Italian News on YouTube
    Samuele D’Avenia, Eliana Di Palma, Lia Draetta, Soda Marem Lo and Marta Marchiori Manerba
  • Beyond Concreteness: the Role of Semantic Specificity in Predicting Lexical Complexity in Italian
    Laura Occhipinti and Marianna Marcella Bolognesi
  • Beyond Language Specialization: A RAG Evaluation of Italian LLMs
    Riccardo Agabiti, Giovanni Trappolini, Salvatore Rago, Raniero Romagnoli, Cristina Giannone and Fabrizio Silvestri
  • Brownie IS-A cake, but sugar is not: Can encoders annotate and clean children’s (mis)built semantic hierarchies?
    Giovanni Puccetti, Adele Loia and Andrea Esuli
  • Can LLMs Match Folk Wisdom? A Contextual Evaluation of Proverb Selection in Romance Dialects of Italy
    Gabriele Errico, Alan Ramponi, Sara Tonelli and Elisabetta Jezek
  • Can Politics be Schizophrenic? Metaphorical and Stigmatizing Use of Psychiatric Terms in Italian News Media
    Ginevra Martinelli, Chiara Barattieri di San Pietro, Marta Bosia and Valentina Bambini
  • CHALLENGE-IT: A Multi-Source Italian Benchmark with Hard Negatives for LLM-Generated Text Detection
    Alessandro Pisent and Fabrizio Silvestri
  • Coherence, Cohesion and Complexity (Co3): a hybrid suite for text analysis
    Alessandro Maisto
  • Coming and Going: Assessing Italian Motion Verb Usage in Language Models
    Maria Pia di Buono, Raffaele Manna, Silvio Calderaro, Mariapia Battipaglia and Johanna Monti
  • Comparing Large Language Models and Humans in Historical Interpretation
    Fabio Celli and Georgios Spathoulas
  • Computational Morphology for Norwegian Medical Compounds: An HMM, Neural, and Neurosymbolic Approach to Morpheme Boundary Detection
    Keziah Reina
  • CorefUD Goes Latin: Enriching a Large Multilingual Coreference Resource with a Classical Language
    Roberta Leotta, Marco Passarotti, Martin Popel and Zdenek Zabokrtsky
  • CoSITA: a Benchmark for Temporally Grounded State-Transition Understanding
    Andrea Pedrotti and Andrea Esuli
  • Creating PFB: Prometeia Financial Benchmark
    Alessandro Pietro Bardelli, Tolga Cekic, Irem Demirtas, Marilena Di Bari, Michele Filannino and Simona Scala
  • DA-Self-AMPLIFY: Improving In-Context Learning with Post-hoc Explanations for Subjective NLP
    Benedetta Muscato, Gizem Gezici and Fosca Giannotti
  • Detecting Semantic Variation between German Standard Varieties through Word Embedding Comparison
    luca ducceschi and Federico Villa
  • Developing a Perspectivist Historical Databank with Large Language Models
    Fabio Celli
  • Dialogue moves and user engagement in Human-LLM Conversational Exchanges
    Martina Di Bratto, Valentina Russo, Azzurra Mancini, Marco Grazioso and Valeria Mauro
  • Discrete Diffusion Language Models: An Experimental Analysis
    Thomas Bertolani, Davide Bucciarelli, Leonardo Zini, Marcella Cornia and Lorenzo Baraldi
  • Do Language Models Know Their Slang? Queer Slang Understanding in User-Generated Content
    Arianna Denitto and Beatrice Savoldi
  • Do LLMs Know Basic Italian? Evaluating Lexical Competence through Dictionary Entry Generation against the De Mauro Basic Vocabulary
    Manuel Gozzi, Guido Vetere and Francesca Fallucchi
  • Do LLMs Truly Reason About Causes? Introducing AITIA, a Contrastive Benchmark for Commonsense Causal Reasoning
    Serena Auriemma, Martina Miliani and Alessandro Lenci
  • Do LVLMs See Stereotypes as We Do? A Social Science Framework for Evaluating LVLMs’ Recognition and Explanation of Stereotypes in Images
    Marco Madeddu, Chiara Ferrando, Elisa Baldazzi, Horacio Jarquin-Vasquez, Marina Della Giusta and Viviana Patti
  • Do We Speak the Same Language? Language, Language Models, and What We’re Talking About
    Malvina Nissim
  • Dromedario-3: Localizing Tülu 3 Dataset to Italian
    Luca Gioffré, Marina Iuliana Aur, Francesco Ortame, Luca Moroni, Alberte Fernández-Castro, Elena Marafatto and Roberto Navigli
  • EDEN: A Large-Scale Corpus of Clinical Notes for Italian
    Tiziano Labruna, Guido Bertolini, Pietro Ferrazzi and Bernardo Magnini
  • Empathy Editing for Italian Medical Question Answering: Can Empathy Be Added Safely?
    Ahmad Reza Yoozbashi Zadeh, Daniela Occhipinti and Alessio Palmero Aprosio
  • Enhanced Retrieval-Augmented Generation for Italian Public Administration Document Drafting
    Giovanni Valer and Alessio Palmero Aprosio
  • Evaluating ASR Architectures for South Tyrolean Dialect to Standard German Translation
    luca ducceschi and Greta H. Franzini
  • Evaluating Italian Readability-Controlled Text Simplification: A Multi-Dimensional Evaluation Framework
    Gaia Federica Francesca Ferrara, Michele Papucci, Felice Dell’Orletta and Giulia Venturi
  • Evaluating LLMs on Target Sentiment Analysis and Emotion Recognition in German and Italian Journalism
    Gloria Comandini, Carlo Strapparava, Federico Collaoni, Charles Biagioni, Sabrina Turco Liveri and Roberto Zanoli
  • Evaluating Transformer Representations of Italian Modal Constructions with Collostructional Analysis and Sentence Embeddings
    Giulia Calvi and Francesco Mambrini
  • Exploring CompL-it: Quantitative and Graph-based Profiling of an Open Italian Lexical-Semantic Resource
    Emiliano Giovannetti, Andrea Bellandi, Simone Marchi and Mafalda Papini
  • FAIR-ISLE: A Bilingual Platform for AI-mediated Inclusive Rewriting and Critical Language Awareness
    Francesca Filograsso, Lucia Siciliani, Rosita Belinda Maglie, Pierpaolo Basile and Marco DeGemmis
  • Fine-tuning Large Language Models on Justinian’s Digest for Latin-to-Italian Specialised Translation
    Eleonora Ghizzota, Pierpaolo Basile, Lucia Siciliani, Paola Marongiu, Alessandra Cinini and Eva Sassolini
  • From Equivalence to Label Flips: A Study of Semantic Consistency in Language Models Using Controlled Linguistic Transformations
    Guillermo Villate, Marco W. Shappeck, Borja Sanz Urquijo and Javier Del Ser
  • From Prompt Engineering to Stimulus Validity: Semantic Constraint Evaluation in Text-to-Image Generation
    Arianna Compostella and Maria Teresa Guasti
  • From Supervised Learning to LLMs: A Multilingual Study of Humor Detection
    Ivana Crescenzi, Jakub Jerzy Górecki, Emanuele Moscato and Debora Nozza
  • From Weights to Representations: How Pre-Training Data Order Shapes Language Models
    Luca Dini, Lucia Domenichelli, Dominique Brunato and Felice Dell’Orletta
  • Generating Synthetic Data for Lexical Semantic Change Detection Over Multiple Time Periods
    Davide Saponara, Nina Tahmasebi and Pierluigi Cassotti
  • How Far Can an Agentic Framework Close the Gap between LLMs and Specialised MT for Low-Resource Languages?
    Jean Maillard, Samuel Frontull, Christopher R. Haberland, Ruth Videsott and Stefano Lusito
  • I luoghi delle partigiane: approcci digitali per l’analisi di un corpus di scritti memorialistici resistenziali femminili
    Irene Caiazzo
  • Identifying the Factors Underlying Differential Object Marking with Language Models: analysis and comparison of Self-Paced Reading data and Transformer-based Surprisal scores
    Giorgio Sciamanna
  • In Short? Straight Paths over Painted Mazes: Humans and LLMs Prefer Simple (Extractive or Abstractive) Summaries to Metaphor-based ones
    Nicola Cirillo, Marzia Postorino, Antonio Schiano, Francesca Turco, Stefano Zoia and Antonio Lieto
  • Intercepting and Traversing a Telegramsphere: Construction and Analysis of the Italian Anti-Vaccine Telegram Corpus
    Selenia Anastasi, Federico Pilati and Anita Lavorgna
  • Investigating Idiomaticity in Word Representations for Italian
    Petra Giommarelli
  • IPA as a Unified Representation for Multilingual ASR
    Ignazio Sorrentino, Marco Matassoni, Roberto Gretter, Daniele Falavigna and Alessio Brutti
  • Italian Sociolinguistics and LLMs: A Study on Diaphasic, Diastratic, and Diatopic Dimensions
    Sveva Silvia Pasini, Calogero Jerik Scozzaro, Daniele P. Radicioni and Viviana Patti
  • Know What You Reward: Criterion-Based Reward Modeling for Summarization
    Olha Khomyn, Edoardo Cecchinato and Giuseppe Riccardi
  • Larry Caused the Car to Stop, But the Model Didn’t Notice: Transformer Blindness to the M-Heuristic
    Butnaru Stefania, Claudiu Creanga and Liviu P. Dinu
  • Linking WordNet to the LinkEn Knowledge Base for a Linked Data Representation of Polysemous Nouns
    Lorenzo Augello and Marco Passarotti
  • Living on the Edge: a Graph-RAG Ablation Study for Cross-Lingual Italian Legal QA
    Rachele Mignone, Davide Liga and Luigi Di Caro
  • LLM-Based Resume–Job Matching: Experiments and Performance
    Elham Sadat Ahmadi, Daria Gordon, Carlo Strapparava and Muhammad Uzair Ul Haq
  • Lost in Transcription: Investigating the Role of Audio Information for Video-based Visual Statement Verification
    Michela Deodati, Mohd Kaif ., Davide Testa, Giovanni Bonetta, Alessandro Lenci, Oswald Lanz, Raffaella Bernardi and Bernardo Magnini
  • Lost in Translation? Watermark Resilience and Perplexity Degradation in Italian LLMs across Resource Tiers
    Davide Altieri, Matteo Pasotti, Elena Opreni, Alice Pietrasanta, Claudio Stamile, Marco Pasqualini, Giulia Rizzi and Elisabetta Fersini
  • Metaphors of Domestic Violence in the Italian Political Discourse: Annotation and Experiments with the ViolMeta Dataset
    Arianna Paola Di Pascale and Rachele Sprugnoli
  • Mining Eruptive Events from Historical Sources: A Taxonomy and LLM-Based Benchmark
    Marius Micluta-Campeanu, Costanza Marini, Alessio Palmero Aprosio and Claudia Principe
  • Mitigating Register- and Authority-Driven Sycophancy via Cross-Lingual Activation Steering
    Gabriele Maraia, Leonardo Ranaldi and Fabio Massimo Zanzotto
  • Morphosyntactic Patterns in Abstractive Summarization: Do LLMs Converge on a Common Italian Variety?
    Donatella Laperchia, Silvia Bernardini and Alberto Barrón-Cedeño
  • Multilingual sentiment analysis: identifying and addressing language-dependent bias without the need for gold labels
    Elisa Di Nuovo, Mara Bernardi, Davide Colla, Nicolas Stefanovitch, Domenico Perrotta, Francesca Torti, Bertrand De Longueville and Charles Macmillan
  • Multimodal Emotional Conflict Resolution in LLMs: A Behavioral Analysis of Incongruent Visual and Linguistic Signals
    Elham Sadat Ahmadi and Carlo Strapparava
  • No One-Size-Fits-All Solution: Evaluating Language Identification Methods for Languages of Italy
    Debora Ciminari and Alberto Barrón-Cedeño
  • Perspective-Aware RAG for Exploring Italian Farmers’ Opinions on the Common Agricultural Policy
    Michael Oliverio, Alessandro Mazzei, Luca Anselma, Marco Vassallo, Concetta Cardillo and Giuliano Gabrieli
  • Plausible but Different: Comparing Human and LLM-Simulated Open-Ended Survey Responses in Italian
    Marco Rospocher, Marco Bombieri, Sofia Cramerotti, Dario Ianes and Benedetta Zagni
  • Pretty Pictures, Shallow Parsing: The Impact of Syntactic Structure on Diffusion Models
    Chiara Ceka, Tiziano Gaddo, Marco La Marra and Roberto Zamparelli
  • Prompt-Based Semantic Grounding via Ontology Injection for Biomedical Document Reranking
    Federico Borazio, Danilo Croce and Roberto Basili
  • PUNder-IT: Assessing Language Models’ Sensitivity to Italian Puns
    Massimiliano Orsini and Dominique Brunato
  • Reading Between the Clues: A Fine-Grained Analysis of Italian Crossword Solving Systems
    Cristiano Ciaccio, Asya Zanollo, Alessio Miaschi, Gabriele Sarti, Felice Dell’Orletta and Malvina Nissim
  • Reading Comprehension Difficulty: Bridging Linguistic Profiling and National Assessment in Education
    Dominique Brunato, Marta Desimoni, Antonella Mastrogiovanni, Simonetta Montemagni, Laura Petrillo and Giulia Venturi
  • RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue
    Sara Candussio, Emanuele Ballarin, Lorenzo Bonin, Sandro Junior Della Rovere and Luca Bortolussi
  • Scaling Italian Foundation Models Improves Expression More Than Knowledge: A Behavioral Model-Diffing Study of the Minerva Family on ITALIC
    Federica Fabri and Alessandro Bondielli
  • Searching for Truth: How Reliably Does Google Surface Fact-Checked Evidence?
    Daniel Russo
  • Semantics over Structure – on the importance of Grounding Concept Embeddings
    Davide Cavicchini, Yesun-Erdene Jargalsaikhan, Fausto Giunchiglia and Jacopo Staiano
  • SENSEI: A Simple, Elegant, and Nimble Subtitle Editing Interface
    Mauro Cettolo, Elia Soliman, Roldano Cattoni, Matteo Negri, Luisa Bentivogli and Alessio Palmero Aprosio
  • Soundtrack 2 My Mood: A RAG-Based LLM System for Emotionally Relatable Music Recommendations
    Filippo De Min, Debora Nozza and Arianna Muti
  • Sparse Autoencoder Latents Are Locally Aligned with Their Explanations
    Francesco Tozzi and Alessandro Bondielli
  • Sparse Autoencoders Reveal Representations of Cognitively Motivated Semantic Categories in LLMs
    Andrea Bruera and Roberto Dessì
  • Temporal Linguistic Escalation Patterns in Clinical Narratives Prior to Clinical Deterioration
    Faizan Nadeem Mufti, Ajithkumar Jayasree Jayakrishna, Het Darshan Mehta, Marco Polignano, Giovanni Semeraro and Ernesto William De Luca
  • The Accent It Believes It Hears: Accent Attribution and Bias in AI Evaluation of Human Speech
    Claudia Soria
  • The effects of benevolent fine-tuning on the safety of the Italian Large Language Models
    Francesca Pulerà, Giulia Rizzi, Giuseppe Magazzù and Elisabetta Fersini
  • The Linguistic History of (In)Fertility: A Diachronic and Cross-Genre Corpus Study
    Agnese Lombardi and Valentina Bambini
  • The Teacher, the Slides, the Classroom
    Arianna Longo, Silvia Casola, Davide Martignetti, Giuseppe Noto and Marco Antonio Stranisci
  • Topics of Resilience: Improving Historical Phase Recognition with Paleo Climate, Risk Management and Topic Modeling
    Konstantina Tripodi, Fabian Weist, Antonio Sottosanti and Fabio Celli
  • Toward Ancient Greek Word Formation: a Digital Resource for Derivational Morphology
    Beatrice Marchesi, Silvia Zampetta, Virginia Mastellari, Luca Brigada Villa, Silvia Luraghi and Chiara Zanchi
  • Towards Italian Concept Modeling: A Case Study on Fine-Tuning a Large Concept Model on the Italian Language
    Elio Musacchio, Lucia Siciliani and Pierpaolo Basile
  • Training Small LLMs from Scratch: Lessons from Zagreus and Nesso
    Alessandro Ercolani, Edoardo Federici, Luisa Bentivogli and Luca Corbucci
  • Understanding Social Workers’ Well-being through Sentiment Analysis
    Rachele Sprugnoli, Teodora Erika Uberti and Maddalena Floriana Grassi
  • Villanova-2B: European Open Multilingual and Multimodal Language Models
    Stefano Simonazzi, Kamyar Zeinalipour, Matteo Gabburo, Daniela Baiamonte, Elena Fano and Andrea Zugarini
  • What is my Age (and Gender) again? Profiling AI Systems Through the Lens of Gender Stereotype Detection
    Davide Testa, Gloria Comandini, Manuela Speranza, Sofia Brenna, Stefania Cavagnoli and Bernardo Magnini
  • When Do Discourse Markers Help? A Multilingual Study of Discourse-Marker Auxiliary Training for NLP
    Guilherme Augusto Rocha de Figueiredo, Michele Luca Contalbo, Matteo Paganelli and Francesco Guerra
  • When Does Whisper Hear a Question? Prosodic and Lexical Cues to Question-Mark Transcription in the KIParla Corpus
    Martina Simonotti and Ludovica Pannitto
  • When Life Gives You Lemons, Make A Bitchin’ Lemonade: Evaluating Synthetic Data in the Context of Slur Reclamation
    Chiara Ferrando, Lia Draetta, Mirko Lai, Giancarlo Ruffo and Viviana Patti
  • When Metrics Miss the Language: Machine Translation Evaluation for Piedmontese
    Yulia Panchenko
  • Who is Responsible? Constructional Patterns of Agency in Italian Political Debate about Environment
    Elisa Chierchiello, Sveva Silvia Pasini, Arianna Paola Di Pascale, Eliana Di Palma and Cristina Bosco
  • Who Judges the Judges? Evaluating LLM-as-a-Judge for Open-Ended Multimodal Tasks
    Davide Testa, Giovanni Bonetta, Leonardo Rigutini and Bernardo Magnini

Research Communications

  • A Survey on Stereotype Detection in Natural Language Processing
    Alessandra Teresa Cignarella, Anastasia Giachanou and Els Lefever
  • An experimental comparison of the most popular approaches to fake news detection
    Pietro Dell’Oglio, Alessandro Bondielli, Francesco Marcelloni and Lucia C. Passaro
  • Differential syntactic and semantic encoding in LLMs
    Santiago Acevedo, Alessandro Laio and Marco Baroni
  • Friend or Foe? A Computational Investigation of Semantic False Friends across Romance Languages
    Liviu P. Dinu, Ana Sabina Uban, Ioan-Bogdan Iordache, Simona Georgescu and Claudia Vlad
  • Head Pursuit: Probing Attention Specialization in Multimodal Transformers
    Lorenzo Basile, Valentino Maiorca, Diego Doimo, Francesco Locatello and Alberto Cazzaniga
  • LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
    Tommaso Bonomo, Luca Gioffré and Roberto Navigli
  • Multi-LMentry: Can Multilingual LLMs Solve Elementary Tasks Across Languages?
    Luca Moroni and Roberto Navigli
  • On automatic decipherment of lost ancient scripts relying on combinatorial optimisation and coupled simulated annealing
    Fabio Tamburini
  • On the impact of pretraining data ordering in transformer encoder- and decoder-only language models
    Luca Dini, Lucia Domenichelli, Dominique Brunato and Felice Dell’Orletta
  • PERSEVAL: A Framework for Perspectivist Classification Evaluation
    Soda Marem Lo, Silvia Casola, Erhan Sezerer, Valerio Basile, Franco Sansonetti, Antonio Uva and Davide Bernardi
  • Perspectives in Play: A Multi-Perspective Approach for More Inclusive NLP Systems
    Benedetta Muscato, Lucia C. Passaro, Gizem Gezici and Fosca Giannotti
  • RETRACEQA: Evaluating Reasoning Traces of Small Language Models in Commonsense Question Answering
    Luca Moroni, Francesco Maria Molfese, Simone Conia and Roberto Navigli
  • The Dangerous Effects of a Frustratingly Easy LLMs Jailbreak Attack
    Marco Bombieri, Simone Paolo Ponzetto and Marco Rospocher
  • The Narrow Gate: Localized Image-Text Communication in Native Multimodal Models
    Alessandro Pietro Serra, Francesco Ortu, Emanuele Panizon, Lucrezia Valeriani, Lorenzo Basile, Alessio Ansuini, Diego Doimo and Alberto Cazzaniga
  • When Harry Meets Superman: The Role of The Interlocutor in Persona-Based Dialogue Generation
    Daniela Occhipinti, Marco Guerini and Malvina Nissim