遇见数据集

WordSeg-Weibo

收藏
OpenXLab2026-04-18 收录
官方服务:

资源简介:

该任务来自NLPCC 2016评估任务。这项任务的目的是研究微博文本的中文分词技术。与传统的单分词评估方法不同,该任务引入了一种新的多粒度分词评估标准。该数据集来自新浪微博。除了训练数据外,我们还提供背景数据,从中提取训练和测试数据。提供背景数据的目的是希望发现更复杂的特征。

提供机构:
OpenDataLab
创建时间:
2023-05-15
二维码
社区交流群
二维码
科研交流群
商业服务