遇见数据集

hadoop-14TB-part2

收藏
Zenodo2025-08-25 更新2026-05-26 收录
官方服务:

资源简介:

Five data nodes worth of logs from a larger 14 TB dataset of Hadoop logs. The logs were generated from three Hadoop clusters, each containing 48 data nodes, running workloads from the HiBench Benchmark Suite for a month. This dataset was first used in the evaluation of "CLP: Efficient and Scalable Search on Compressed Text Logs."

本数据集取自总规模为14 TB的Hadoop日志数据集,包含5个数据节点的日志记录。这些日志源自三个各配备48个数据节点的Hadoop集群,且所有集群均运行了来自HiBench基准测试套件的工作负载,实验周期为一个月。该数据集首次被应用于《CLP:压缩文本日志上的高效可扩展搜索》一文的评估工作。

提供机构:
Zenodo
创建时间:
2025-08-25
二维码
社区交流群
二维码
科研交流群
商业服务