Competitor Raw Data
收藏资源简介:
El dataset contiene una línea por cada producto publicado en el sitio web de muebles en cuestión al momento de la extracción. Por cada ítem se obtendrán los siguientes datos: <strong><em>Title</em></strong>: Nombre del producto. <strong><em>Price</em></strong>: Precio del producto. <strong><em>Category_path</em></strong>: categoría a la cual pertenece el producto. <strong><em>Rating</em></strong>: el rating es el promedio de las calificaciones recibidas por parte de los compradores del producto. <strong><em>Qty_califications</em></strong>: cantidad de calificaciones recibidas. <strong><em>Features_JSON_format</em></strong>: se guarda en un solo campo y en formato JSON las medidas y/o características del producto. Se elige este formato por dos razones principales: Cada producto puede tener diferentes características de acuerdo a su categoría que hacen que tengan n posibles features y medidas, por ej, podemos tener una lata de barniz con una única característica como ser la capacidad en litros, hasta una cama donde podemos tener el ancho, largo, altura, el tipo de madera, etc. Al ser esta info extraída via web scraping y al considerarla raw data creemos que como primer stage del dato es válida conservarla de esta manera. Podrán ser parseados estos en etapas posteriores según sea necesario y según la categoría del producto. <strong><em>Image_Url</em></strong>: url de la primera imagen del producto en la publicación. <strong><em>Item_Url</em></strong>: url del producto dentro del sitio web.



