CorpusSubt_EspOriginal2025
收藏官方服务:
资源简介:
Este corpus ha sido compilado a partir de subtítulos de películas y series españolas originales (2010–2025), con el fin de estudiar patrones de la lengua española. El archivo contiene líneas de diálogo en español peninsular, en formato texto plano (.txt), con una limpieza previa que elimina marcas de tiempo, nombres de personajes, líneas vacías, duplicadas y errores de codificación.
本语料库(corpus)由2010至2025年的原创西班牙影视(电影与剧集)字幕汇编所得,旨在研究西班牙语的语言模式。该语料库文件包含伊比利亚半岛西班牙语的对话文本行,采用纯文本(.txt)格式存储,并经过前期清洗处理,移除了时间戳、角色名称、空行、重复内容及编码错误。
提供机构:
Zenodo创建时间:
2025-06-29



