官方服务:
资源简介:
该仓库专注于心理健康领域的文本分类任务,提供英文数据集,规模在1千到1万条样本之间,并采用MIT许可。
应用场景:
创建时间:
2024-07-19
相关数据集
认知扭曲和自杀风险分类数据集
本研究引入了两个新的标注数据集,专注于中国社交媒体上的认知扭曲和自杀风险分类。这些数据集由专家手动标注,旨在为社区提供宝贵的资源,并具有深远的现实意义,可能为自杀预防和认知扭曲干预策略提供信息。数据集包含来自微博社交平台的评论,由合格的心理学家团队进行标注。自杀风险数据集包含648条低风险记录和601条高风险记录,而认知扭曲数据集包含910条记录。这些数据集不仅服务于社区,还旨在解决心理健康领域中
arXiv2023-11-01 更新890
Binary Labeled Depression Corpus of 57000 English tweets
This is a new English corpus for depression detection from Twitter which contains negation words. This corpus consists of 57,391 tweets classified into 25,233 of 1 which means "depressed" tweets, and
NIAID Data Ecosystem70
Model predictions and dataset statements.
The cognitive distortion dataset includes statements within the dataset and also encompasses the responses provided by the ChatPSY and GPT-4 model to these statements, along with their predictions.
Figshare2024-02-10 更新60
SDCNL
我们根据我们的自杀或抑郁分类任务开发了一个主要数据集。该数据集是从 Reddit 网络抓取的。我们使用 Python Reddit API 从 subreddits 收集数据。我们专门从两个子版块 r/SuicideWatch3 和 r/Depression 中抓取。该数据集总共包含 1,895 个帖子。我们利用抓取数据中的两个字段:帖子的原始文本作为我们的输入,它所属的 subreddit 作为
OpenCSG2024-04-23 更新110
Telugu_Suicide_Based心理健康检测泰卢固语文本数据集
本数据集是Kaggle英文自杀检测数据集前5万行的泰卢固语翻译版,使用IndicTrans2翻译模型生成。核心内容为含自杀倾向标注的泰卢固语文本,每条数据包含文本内容及“自杀倾向”或“非自杀倾向”的分类标签,旨在支持泰卢固语心理健康检测相关研究,共包含2个文件。 Kaggle英文自杀检测数据集(https://www.kaggle.com/datasets/nikhileswarkomati/su
海数据70



