遇见数据集

Dataset Corpus Indonesia

收藏
Zenodo2025-06-02 更新2026-05-26 收录
官方服务:

资源简介:

Nama Datase : Corpus Indonesia Pemilik : Achmad Shidiq Nur Fazar Kaggle : https://www.kaggle.com/datasets/achmadshidiq/corpus-bahasa-indonesia-label Dataset ini merupakan dataset untuk analisis sentimen yang terdiri dari dua kolom utama: kolom "kalimat" dan kolom "sentimen." Kolom "kalimat" berisi teks atau kalimat yang akan dianalisis, sementara kolom "sentimen" berisi label yang mengindikasikan jenis sentimen dari masing-masing kalimat. Label pada kolom "sentimen" dikategorikan menjadi tiga kelas utama: Label 0: Menunjukkan bahwa kalimat memiliki sentimen netral. Sentimen netral berarti tidak ada emosi atau opini yang kuat terhadap suatu subjek dalam kalimat tersebut. Label 1: Menunjukkan bahwa kalimat memiliki sentimen positif. Sentimen positif berarti kalimat tersebut mengandung emosi atau opini yang mendukung atau menyenangkan terhadap suatu subjek. Label 2: Menunjukkan bahwa kalimat memiliki sentimen negatif. Sentimen negatif berarti kalimat tersebut mengandung emosi atau opini yang tidak mendukung atau tidak menyenangkan terhadap suatu subjek. Dataset ini dapat digunakan untuk melatih model pembelajaran mesin dalam tugas-tugas klasifikasi teks, khususnya dalam mengidentifikasi dan mengkategorikan sentimen dalam teks. Analisis sentimen ini berguna dalam berbagai aplikasi, seperti analisis ulasan produk, pemantauan media sosial, dan peningkatan layanan pelanggan. Dengan memahami sentimen dari kalimat-kalimat ini, organisasi dapat mengambil keputusan yang lebih tepat berdasarkan opini publik.

提供机构:
Zenodo
创建时间:
2025-06-02
二维码
社区交流群
二维码
科研交流群
商业服务