Dataset de fichas de películas extraído de eCartelera
收藏资源简介:
El dataset propuesto está formado por fichas de películas extraídas de la web eCartelera. Cada fila del conjunto de datos representa una película y cada columna corresponde a una de las variables obtenidas de su ficha pública. El objetivo de este conjunto de datos es reunir, en un único archivo estructurado, información descriptiva sobre distintas películas. Entre los campos recogidos se encuentran el título, el título original, el año, el país, la duración, los géneros, la distribuidora, la clasificación por edades, la fecha de estreno en España, la dirección, el reparto, la URL de la ficha y la fecha de extracción. Se trata de un dataset original generado mediante técnicas de web scraping, a partir de la navegación automática por distintas páginas del sitio web. El resultado final se almacena en formato CSV, lo que facilita tanto su consulta como su posible reutilización en análisis posteriores.



