登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
文本分割-中文-通用领域
文本分割-中文-通用领域
收藏
魔搭社区
2026-06-23 更新
2024-05-15 收录
自然语言处理
文本分割
数据链接:
https://modelscope.cn/datasets/modelscope/wiki-document-segmentation
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
基于wiki的文本分割数据集
Wiki-based Text Segmentation Dataset
应用场景:
提供机构:
maas
创建时间:
2022-11-29
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集是用于中文文本分割模型fine tune的样例数据,采样自中文wiki数据集,适用于通用领域的文本分割任务。
以上内容由遇见数据集搜集并总结生成
相关数据集
YPG1-20191126_17 - Postsession
自然语言处理
Phola语言
Spontaneous dialogues.. Language as given: Phola
Research Data Australia
5
0
Spelling Difficulty Prediction
拼写错误检测
自然语言处理
Extracted spelling errors from various corpora.
B2FIND
2
0
YOLO模型
数据集文件元信息以及数据文件,请浏览“数据集文件”页面获取。 当前数据集卡片使用的是默认模版,数据集的贡献者未提供更加详细的数据集介绍,但是您可以通过如下GIT Clone命令,或者ModelScope SDK来下载数据集 #### 下载方法 :modelscope-code[]{type="sdk"} :modelscope-code[]{type="git"}
魔搭社区
2026-08-08 更新
0
0
NotEvilAI/ru-reasoning-generator
自然语言处理
该数据集包含消息内容和角色的信息,以及消息的语言类型。它被分为训练集,共有93966个示例,数据集大小为633037353字节。
Hugging Face
2025-09-12 更新
3
0
insert_block
数据集文件元信息以及数据文件,请浏览“数据集文件”页面获取。 当前数据集卡片使用的是默认模版,数据集的贡献者未提供更加详细的数据集介绍,但是您可以通过如下GIT Clone命令,或者ModelScope SDK来下载数据集 #### 下载方法 :modelscope-code[]{type="sdk"} :modelscope-code[]{type="git"}
魔搭社区
2026-08-08 更新
0
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广