Dataset de fichas de películas extraído de eCartelera
收藏资源简介:
El dataset propuesto está formado por fichas de películas extraídas de la web eCartelera. Cada fila del conjunto de datos representa una película y cada columna corresponde a una de las variables obtenidas de su ficha pública. El objetivo de este conjunto de datos es reunir, en un único archivo estructurado, información descriptiva sobre distintas películas. Entre los campos recogidos se encuentran el título, el título original, el año, el país, la duración, los géneros, la distribuidora, la clasificación por edades, la fecha de estreno en España, la dirección, el reparto, la URL de la ficha y la fecha de extracción. Se trata de un dataset original generado mediante técnicas de web scraping, a partir de la navegación automática por distintas páginas del sitio web. El resultado final se almacena en formato CSV, lo que facilita tanto su consulta como su posible reutilización en análisis posteriores.
本数据集由从影视资讯网站eCartelera爬取的电影详情条目构成。数据集中每一行对应一部电影,每一列则对应其公开详情页中的一项采集变量。 本数据集的构建目标是将各类电影的描述性信息整合至单一结构化文件中。所采集的字段涵盖影片标题、原版标题、上映年份、出品国家、片长、影片类型、发行公司、年龄分级、西班牙地区上映日期、导演、参演阵容、详情页URL以及数据爬取日期。 本数据集为原创数据集,通过网络爬虫(web scraping)技术生成,依托自动化导航遍历该网站的多个页面完成数据采集。最终采集结果以CSV格式存储,既便于数据查询,也可在后续分析工作中便捷复用。



