遇见数据集

Competitor Raw Data

收藏
Zenodo2021-04-11 更新2026-05-25 收录
数据链接:
官方服务:

资源简介:

El dataset contiene una línea por cada producto publicado en el sitio web de muebles en cuestión al momento de la extracción. Por cada ítem se obtendrán los siguientes datos: <strong><em>Title</em></strong>: Nombre del producto. <strong><em>Price</em></strong>: Precio del producto. <strong><em>Category_path</em></strong>: categoría a la cual pertenece el producto. <strong><em>Rating</em></strong>: el rating es el promedio de las calificaciones recibidas por parte de los compradores del producto. <strong><em>Qty_califications</em></strong>: cantidad de calificaciones recibidas. <strong><em>Features_JSON_format</em></strong>: se guarda en un solo campo y en formato JSON las medidas y/o características del producto. Se elige este formato por dos razones principales: Cada producto puede tener diferentes características de acuerdo a su categoría que hacen que tengan n posibles features y medidas, por ej, podemos tener una lata de barniz con una única característica como ser la capacidad en litros, hasta una cama donde podemos tener el ancho, largo, altura, el tipo de madera, etc. Al ser esta info extraída via web scraping y al considerarla raw data creemos que como primer stage del dato es válida conservarla de esta manera. Podrán ser parseados estos en etapas posteriores según sea necesario y según la categoría del producto. <strong><em>Image_Url</em></strong>: url de la primera imagen del producto en la publicación. <strong><em>Item_Url</em></strong>: url del producto dentro del sitio web.

提供机构:
Zenodo
创建时间:
2021-04-11
二维码
社区交流群
二维码
科研交流群
商业服务