bias etnici nel giornalismo italiano
收藏资源简介:
Questa risorsa è stata realizzata nell’ambito dell’esame magistrale “Dati e modelli multilinguistici per l’applicazione in Digital Humanities”. Il progetto consiste nella costruzione, annotazione e analisi di due corpora di articoli di cronaca provenienti da tre quotidiani italiani (La Repubblica, Il Corriere della Sera, Il Mattino) con l’obiettivo di individuare e descrivere fenomeni di bias etnico nel linguaggio giornalistico. La risorsa comprende: il corpus annotato le grammatiche e i dizionari sviluppati in Nooj un breve manuale d’uso per il riutilizzo del dataset Il progetto integra approcci di sociolinguistica, discourse analysis e linguistica computazionale, con particolare attenzione ai processi di rappresentazione etnica nei media e alle modalità di annotazione e validazione dei bias.
本资源为完成硕士学位课程《面向数字人文应用的多语言数据与模型》(Dati e modelli multilinguistici per l’applicazione in Digital Humanities)所制作。本项目旨在构建、标注并分析来自三份意大利报纸的两批新闻报道语料库,涉及报纸包括《共和国报》(La Repubblica)、《晚邮报》(Il Corriere della Sera)与《晨报》(Il Mattino),核心目标为识别并描述新闻语言中的族群偏见现象。 本数据集包含以下内容: 1. 标注语料库 2. 基于Nooj工具开发的语法规则与词典 3. 面向数据集复用的简易使用手册 本项目融合了社会语言学、话语分析(Discourse Analysis)与计算语言学(Computational Linguistics)的研究方法,重点关注媒体中的族群表征过程,以及偏见的标注与验证流程。



