登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
第二次国际汉语分词转换数据
第二次国际汉语分词转换数据
收藏
DataFountain
2024-10-31 更新
2026-04-18 收录
中文分词
分词标准转换
数据链接:
https://www.datafountain.cn/datasets/5668
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
分词转换数据集
应用场景:
提供机构:
Hua十多个
创建时间:
2021-01-08
相关数据集
NLPCC2016
自然语言处理
中文分词
NLPCC2016数据集与热门新闻数据集不同,使用了更多来自新浪微博的非正式文本。培训和测试数据由来自不同主题的微博组成,例如金融,体育,娱乐等。数据集采用utf-8编码,可用于中文分词任务。
OpenDataLab
2026-07-12 更新
71
0
ailabs1k7 (AIlabs.tw Pop1K7)
自然语言处理
中文分词
https://github.com/YatingMusic/compound-word-transformer
OpenDataLab
2026-07-12 更新
18
0
tjspross/msr
中文分词
自然语言处理
该数据集包含两个主要字段:tokens和cws_tags。tokens字段是一个字符串序列,cws_tags字段是一个带有类别标签的序列,标签包括B-SEG、M-SEG、E-SEG和S-SEG。数据集分为训练集、测试集和开发集,分别包含78225、3985和8693个样本。
Hugging Face
2024-01-04 更新
11
0
UD-Chinese-GSD
自然语言处理
中文分词
UD-Chinese-GSD数据集是一个传统的中文自然语言处理数据集,用于汉语分词等工作中的训练,也可用于多语言编译器开发和跨语言研究。
OpenDataLab
2026-07-12 更新
37
0
关系抽取数据集
关系抽取
自然语言处理
来自github的关系抽取数据集。
DataFountain
2026-06-01 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广