登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
<p>Sentence structure conversion by separating punctuation.</p>
<p>Sentence structure conversion by separating punctuation.</p>
收藏
NIAID Data Ecosystem
2026-05-10 收录
句子分割
标点分离
数据链接:
https://figshare.com/articles/dataset/_p_Sentence_structure_conversion_by_separating_punctuation_p_/31415017
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Sentence structure conversion by separating punctuation.
应用场景:
创建时间:
2026-02-25
相关数据集
mySentence Corpus
缅甸语
句子分割
mySentence Corpus是一个用于缅甸语句子分割的语料库,包含了从多个来源收集的句子数据,并进行了详细的标注和处理,以支持机器学习模型在自动语音识别、语音合成等应用中的句子边界识别。
github
2023-07-30 更新
114
0
HSplit-corpus
句子分割
语料库
黄金标准句子分割语料库,由4位标注者根据Xu等人2016年的测试语料库的复杂部分,遵循句子分割指南生成。HSplit 1和2遵循第一套指南,HSplit 3和4遵循第二套指南。该语料库包含359个句子。
github
2022-04-18 更新
20
0
cnbeining/sentence-segmentation
句子分割
自然语言处理
--- license: lgpl-3.0 dataset_info: features: - name: input sequence: string - name: output sequence: sequence: string splits: - name: train num_bytes: 4510793 num_exam
Hugging Face
2024-02-18 更新
7
0
MINWIKISPLIT
自然语言处理
句子分割
MINWIKISPLIT是一个由圣加仑大学创建的大型句子分割数据集,包含203,000对复杂的源句及其简化的目标句。该数据集通过将每个输入句子分解为一系列最小命题,即每个句子都是自包含的、无法进一步分解的语义单元,来简化复杂的语言结构。创建过程中,使用了35条手工编写的转换规则来分解各种语言结构,并通过依赖解析和词性标注的启发式方法来保证输出质量。该数据集主要用于训练自然语言处理模型,以改善下游语
arXiv
2019-09-26 更新
85
0
wiki_split
自然语言处理
句子分割
# Dataset Card for "wiki_split" ## Table of Contents - [Dataset Description](#dataset-description) - [Dataset Summary](#dataset-summary) - [Supported Tasks and Leaderboards](#supported-tasks-and
魔搭社区
2026-06-25 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广