遇见数据集

UGSC Multilingual Sentiment Dataset for Sustainable Urban Mobility

收藏
Zenodo2026-05-15 更新2026-05-26 收录
官方服务:

资源简介:

The UGSC-ML dataset is the multilingual version of the User Gold Standard Corpus (UGSC)for sustainable urban mobility sentiment analysis. It consists of 375 English transport-related user reviews from TripAdvisor withsentence-aligned translations in Spanish, French, German, and Italian, yielding1,875 instances across five languages. The CardiffNLP XLM-RoBERTa model (`cardiffnlp/twitter-xlm-roberta-base-sentiment`)is applied in zero-shot domain transfer mode: pre-trained on CC100 and fine-tunedon Twitter sentiment data, then applied without any task- or domain-specific fine-tuningto transport reviews.

提供机构:
Zenodo
创建时间:
2026-05-15
二维码
社区交流群
二维码
科研交流群
商业服务