遇见数据集

markrogolino/reddit_dataset_156

收藏
Hugging Face2025-05-19 更新2025-10-25 收录
官方服务:

资源简介:

Bittensor Subnet 13 Reddit数据集是Bittensor Subnet 13网络的组成部分,包含不断更新的预处理Reddit数据。数据集适用于多种自然语言处理任务,如情感分析、主题建模、社区分析和内容分类等。数据主要是英文,但也可能是多语言的。数据集持续更新,没有固定的分割,用户应根据需要和时间戳创建自己的数据分割。

The Bittensor Subnet 13 Reddit dataset is part of the Bittensor Subnet 13 network, containing continuously updated preprocessed Reddit data. The dataset is suitable for various natural language processing tasks such as sentiment analysis, topic modeling, community analysis, and content categorization. The data is primarily in English but can also be multilingual. The dataset is continuously updated without fixed splits, and users should create their own data splits based on requirements and timestamps.

提供机构:
markrogolino
二维码
社区交流群
二维码
科研交流群
商业服务