登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Sexting
Sexting
收藏
arXiv
2025-09-30 收录
微信内容分析
色情文本识别
数据链接:
https://github.com/mathigatti/sexting-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该数据集是一份英文色情文本集合,包含了537条涉及性内容的短信信息。
应用场景:
提供机构:
GitHub
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集是一个从互联网公开资源(如博客、论坛和社交媒体)抓取的情色聊天记录集合,主要用于聊天机器人训练或相关研究。数据集包含整理后的文本对话和原始文件,但主要偏向顺性别异性恋内容,鼓励贡献以增加多样性。
以上内容由遇见数据集搜集并总结生成
相关数据集
公众号及智能标签
微信内容分析
行业数据分析
覆盖1000+财经类、行业类公众号,可定向采集指定公众号,包含文章标题、摘要、时间、标签等结构化数据
西部数据交易中心
2024-08-23 更新
23
0
bersov75/reddit_dataset_236
微信内容分析
Reddit社区动态
该数据集是Bittensor Subnet 13去中心化网络的一部分,包含预处理的Reddit数据。数据由网络矿工持续更新,提供实时的Reddit内容流,适用于各种分析和机器学习任务。数据集支持情感分析、主题建模、社区分析和内容分类等多种任务。
Hugging Face
2025-05-29 更新
7
0
Summary of data collected from the three styles of ESC posted to Instagram and TikTok.
微信内容分析
短视频表现评估
Summary of data collected from the three styles of ESC posted to Instagram and TikTok.
NIAID Data Ecosystem
5
0
ML Pitfalls Responses
机器学习
自然语言处理
该数据集包含了1600个由不同大型语言模型(LLM)生成的原始响应,这些响应是针对机器学习代码样本的。数据集涵盖了多个LLM的响应,并对比了它们在机器学习管道不同阶段识别陷阱的能力。该数据集的任务是评估LLM在识别机器学习代码中常见误区方面的能力。
arXiv
11
0
Appendix 7.1 WeChat data (Nov. 2018 - Dec. 2019)
微信内容分析
社交媒体审查
The dataset contains WeChat posts uploaded by 47 most influential WeChat official accounts from November 2018 to December 2019. Column introduction:seq: serial number of WeChat postid: unique i
Figshare
2022-02-02 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广