JOWIGOZA/spam_ham_spanish
收藏资源简介:
--- license: apache-2.0 language: - es size_categories: - n<1K tags: - code pretty_name: Spam - Ham, Spanish Dataset --- # Análisis de Dataset de Mensajes de Texto Este dataset contiene un total de 1000 mensajes de texto en español, junto con una etiqueta que indica si el mensaje es considerado "spam" o "ham" (legítimo). # Composición del Dataset El dataset está compuesto por dos columnas: Mensaje: Contiene el texto del mensaje. Etiqueta: Indica si el mensaje es "spam" o "ham". # Potenciales Usos Este dataset puede ser utilizado para entrenar modelos de Machine Learning con el objetivo de clasificar automáticamente mensajes de texto como spam o legítimos. Algunas posibles aplicaciones incluyen: Filtros de spam para servicios de mensajería y email. Análisis de sentimiento en mensajes de texto. Detección de fraude y estafas a través de mensajes de texto.
许可证:Apache-2.0 语言: - 西班牙语 样本规模类别: - 样本数少于1000 标签: - 代码 展示名称:垃圾邮件与合法邮件西班牙语数据集(Spam - Ham, Spanish Dataset) # 文本消息数据集分析 本数据集共包含1000条西班牙语文本消息,并附带标签以标识该消息为“垃圾邮件(spam)”或“合法邮件(ham,即非垃圾邮件)”。 # 数据集构成 本数据集包含两列数据: 消息列:存储文本消息的具体内容。 标签列:用于标识消息为“垃圾邮件(spam)”或“合法邮件(ham)”。 # 潜在应用场景 本数据集可用于训练机器学习模型,以实现文本消息的自动分类(区分垃圾邮件与合法邮件)。 部分潜在应用包括: - 面向即时通讯与电子邮件服务的垃圾邮件过滤系统 - 文本消息情感分析 - 基于文本消息的欺诈与诈骗检测



