Kaggle eCommerce Data|电子商务数据集|数据分析数据集
收藏
- Kaggle首次发布E-Commerce Data数据集,该数据集包含一家非商店零售商的在线交易数据,涵盖2010年12月至2011年12月期间的交易记录。
- 数据集被广泛应用于机器学习和数据分析竞赛中,成为研究客户行为和销售预测的重要资源。
- 学术界开始引用该数据集,发表了多篇关于客户细分和市场分析的研究论文。
- 数据集的应用扩展到商业智能领域,多家企业利用该数据集进行市场策略优化和客户关系管理。
- Kaggle对数据集进行了更新,增加了更多维度的数据,如客户地理位置和产品类别,以支持更深入的分析。
- 数据集被用于多个在线课程和培训项目,成为数据科学教育的重要教学资源。
- 随着数据科学和人工智能技术的发展,该数据集的应用场景进一步扩展,涉及预测分析、推荐系统和个性化营销等多个领域。
- 1Kaggle eCommerce Data: A Comprehensive Analysis of Online Retail TransactionsKaggle · 2015年
- 2Exploring Customer Behavior in Online Retail: A Data-Driven ApproachIEEE · 2018年
- 3Predictive Analytics in E-commerce: A Case Study Using Kaggle DataElsevier · 2019年
- 4Customer Segmentation in Online Retail: Insights from Kaggle DataTaylor & Francis · 2020年
- 5Time Series Forecasting in E-commerce: A Kaggle Data-Based StudySpringer · 2021年
LFW
人脸数据集;LFW数据集共有13233张人脸图像,每张图像均给出对应的人名,共有5749人,且绝大部分人仅有一张图片。每张图片的尺寸为250X250,绝大部分为彩色图像,但也存在少许黑白人脸图片。 URL: http://vis-www.cs.umass.edu/lfw/index.html#download
AI_Studio 收录
GME Data
关于2021年GameStop股票活动的数据,包括每日合并的GME短期成交量数据、每日失败交付数据、可借股数、期权链数据以及不同时间框架的开盘/最高/最低/收盘/成交量条形图。
github 收录
CE-CSL
CE-CSL数据集是由哈尔滨工程大学智能科学与工程学院创建的中文连续手语数据集,旨在解决现有数据集在复杂环境下的局限性。该数据集包含5,988个从日常生活场景中收集的连续手语视频片段,涵盖超过70种不同的复杂背景,确保了数据集的代表性和泛化能力。数据集的创建过程严格遵循实际应用导向,通过收集大量真实场景下的手语视频材料,覆盖了广泛的情境变化和环境复杂性。CE-CSL数据集主要应用于连续手语识别领域,旨在提高手语识别技术在复杂环境中的准确性和效率,促进聋人与听人社区之间的无障碍沟通。
arXiv 收录
FER2013
FER2013数据集是一个广泛用于面部表情识别领域的数据集,包含28,709个训练样本和7,178个测试样本。图像属性为48x48像素,标签包括愤怒、厌恶、恐惧、快乐、悲伤、惊讶和中性。
github 收录
CliMedBench
CliMedBench是一个大规模的中文医疗大语言模型评估基准,由华东师范大学等机构创建。该数据集包含33,735个问题,涵盖14个核心临床场景,主要来源于顶级三级医院的真实电子健康记录和考试练习。数据集的创建过程包括专家指导的数据选择和多轮质量控制,确保数据的真实性和可靠性。CliMedBench旨在评估和提升医疗大语言模型在临床决策支持、诊断和治疗建议等方面的能力,解决医疗领域中模型性能评估的不足问题。
arXiv 收录