Temps de parole des hommes et des femmes à la télévision et à la radio
收藏资源简介:
Temps de parole des hommes et des femmes, correspondant à plus d'un million d'heures de programmes diffusés de 1995 au 28 février 2019. Les temps de parole sont obtenus automatiquement à l'aide du logiciel libre [inaSpeechSegmenter](http://github.com/ina-foss/inaSpeechSegmenter), développé à l'INA. Ce logiciel est basé sur des algorithmes d'apprentissage automatique (sous-famille de l'intelligence artificielle) entraînés sur un grand nombre d'exemples de musique, de voix de femme et de voix d'homme, afin de détecter les zones de musique et les zones de parole contenues dans les documents audiovisuels. Les temps de parole sont estimés par tranches d'une heure, de 5h à minuit pour la radio et de 10h à minuit pour la télévision. Les 21 stations de radio analysées sont Chérie FM, Europe 1, France Bleu, France Culture, France Info, France Inter, France Musique, Fun Radio, Mouv’, NRJ, Nostalgie, RFM, RMC, RTL, RTL 2, Radio Classique, Radio France Internationale, Rire et Chansons, Skyrock, Sud Radio et Virgin Radio. Les 34 chaînes de TV analysées sont Arte, Animaux, BFM TV, Canal+, Canal+ Sport, Chasse et pêche, Chérie 25, Comédie+, D8/C8, Euronews, Eurosport France, France 2, France 24, France 3, France 5, France O, Histoire, I-Télé/CNews, L'Equipe 21, LCI, LCP/Public Sénat, La chaîne Météo, M6, Monte Carlo TMC, NRJ 12, Paris Première, Planète+, TF1, TV Breizh, TV5 Monde, Toute l'Histoire, Téva, Voyage, W9 Le fonctionnement du logiciel d’analyse automatique utilisé sur les documents audiovisuels, ainsi que l’estimation de sa fiabilité, sont décrits dans l'article ci-dessous: David Doukhan et Jean Carrive, "[Description automatique du taux d’expression des femmes dans les flux télévisuels français](https://www.isca-archive.org/jep_2018/doukhan18_jep.pdf)", XXXIIe Journées d’Études sur la Parole, Juin 2018 Les relations existant entre le temps de parole, pourcentage de visages, nombre de mentions orales et décomptes manuels sont détaillées dans l'article ci-dessous: David Doukhan, Lena Dodson, Manon Conan, Valentin Pelloin, Aurélien Clamouse, Mélina Lepape, Géraldine Van Hille, Cécile Méadel et Marlène Coulomb-Gully, "[Gender Representation in TV and Radio: Automatic Information Extraction methods versus Manual Analyses ](https://www.isca-archive.org/interspeech_2024/doukhan24_interspeech.pdf)", pages 3060-3064,Interspeech 2024
男女发言时长数据集,涵盖1995年至2019年2月28日期间播出的超百万小时音视频节目。 该数据集的发言时长通过法国国家视听研究院(INA)开发的开源软件inaSpeechSegmenter自动计算得到。该软件基于机器学习(人工智能的子领域)算法构建,通过海量音乐、女声及男声样本进行训练,用于识别音视频素材中的音乐片段与发言片段。 发言时长以小时为单位进行统计,广播节目统计时段为每日5时至次日凌晨,电视节目统计时段为每日10时至次日凌晨。 本次分析涵盖21家广播电台,分别为:Chérie FM、Europe 1、France Bleu、France Culture、France Info、France Inter、France Musique、Fun Radio、Mouv’、NRJ、Nostalgie、RFM、RMC、RTL、RTL 2、Radio Classique、Radio France Internationale、Rire et Chansons、Skyrock、Sud Radio及Virgin Radio。 本次分析涵盖34个电视频道,分别为:Arte、Animaux、BFM TV、Canal+、Canal+ Sport、Chasse et pêche、Chérie 25、Comédie+、D8/C8、Euronews、Eurosport France、France 2、France 24、France 3、France 5、France O、Histoire、I-Télé/CNews、L'Equipe 21、LCI、LCP/Public Sénat、La chaîne Météo、M6、Monte Carlo TMC、NRJ 12、Paris Première、Planète+、TF1、TV Breizh、TV5 Monde、Toute l'Histoire、Téva、Voyage及W9。 针对该音视频自动分析软件的工作原理及其可靠性评估的详细说明,可参阅以下论文: David Doukhan与Jean Carrive,《法国电视流中女性发言占比的自动描述》(https://www.isca-archive.org/jep_2018/doukhan18_jep.pdf),第32届言语研究学术年会,2018年6月。 关于发言时长、人脸占比、口头提及次数与人工统计结果之间的关联,可参阅以下论文: David Doukhan、Lena Dodson、Manon Conan、Valentin Pelloin、Aurélien Clamouse、Mélina Lepape、Géraldine Van Hille、Cécile Méadel及Marlène Coulomb-Gully,《电视与广播中的性别表征:自动信息提取方法 vs. 人工分析》(https://www.isca-archive.org/interspeech_2024/doukhan24_interspeech.pdf),Interspeech 2024,第3060-3064页。



