登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
D435_Chinese_Text_Normalization_Data
D435_Chinese_Text_Normalization_Data
收藏
OpenCSG
2026-03-04 更新
2026-03-14 收录
文本处理
文本规范化
数据链接:
https://opencsg.com/datasets/DatatangBeijing/D435_Chinese_Text_Normalization_Data?tab=summary
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
本套TN数据包括200,475句原始文本,每句标注文本中的特殊符号及数字的汉字读法。
应用场景:
提供机构:
DatatangBeijing
创建时间:
2026-03-04
相关数据集
dgambettaphd/D_gen0_run0_llama2-7b_wiki_doc1000_real64_synt64_vuw
文本处理
自然语言处理
该数据集包含1000个样本,每个样本具有唯一的标识符(id)和文档内容(doc)。数据集分为一个训练集,文件大小为580426字节,下载大小为358365字节。
Hugging Face
2024-12-15 更新
13
0
AdoCleanCode/file_name_dataset-c06_lib04-probs
文本处理
机器学习
该数据集包含了文本ID、实际总对数概率、实际平均对数概率、实际单词概率、移位总对数概率、移位平均对数概率和移位单词概率等字段。数据集分为训练集,共有282个示例,大小为3.34MB。数据集下载大小为2.15MB。
Hugging Face
2025-11-13 更新
11
0
jkeisling/projectgutenberg-kokoro_v1-mimi
文本处理
语音识别
该数据集包含四个字段:整数序列的codes、规范化文本的text_normalized、音素序列的phonemes和说话者ID的speaker_id。数据集提供了一个训练集,包含300万个示例,总大小约为16GB。数据集适用于需要处理文本和音频数据的NLP和语音处理任务。
Hugging Face
2025-02-02 更新
8
0
Income Text Utils API
文本处理
API工具
Text utility API with slug, clean, upper/lower, stats operations
RapidAPI
2025-12-10 更新
13
0
Minata/70000_method2test_tokonized
文本处理
序数数据
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 46676000
Hugging Face
2023-02-26 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广