hadoop-14TB-part2
收藏官方服务:
资源简介:
Five data nodes worth of logs from a larger 14 TB dataset of Hadoop logs. The logs were generated from three Hadoop clusters, each containing 48 data nodes, running workloads from the HiBench Benchmark Suite for a month. This dataset was first used in the evaluation of "CLP: Efficient and Scalable Search on Compressed Text Logs."
本数据集取自总规模为14 TB的Hadoop日志数据集,包含5个数据节点的日志记录。这些日志源自三个各配备48个数据节点的Hadoop集群,且所有集群均运行了来自HiBench基准测试套件的工作负载,实验周期为一个月。该数据集首次被应用于《CLP:压缩文本日志上的高效可扩展搜索》一文的评估工作。
提供机构:
Zenodo创建时间:
2025-08-25



